Čínská AI laboratoř právě vydala bezplatný model, který získává 80,8 na SWE-Bench Verified a 75,3 na Terminal-Bench 2.1, čímž se dostává do stejné ligy jako GPT-5.5 a Claude Opus 4.7 ve skutečné programátorské práci. Jmenuje se Nex-N2-Pro, vyšel 2. června 2026 a jeho stažení nic nestojí. Model pochází od Nex AGI, dodává se pod permisivní licencí Apache 2.0 a je postavený přímo pro agentní úlohy, jako je psaní kódu, volání nástrojů a samostatné provádění dlouhých, vícekrokových pracovních postupů.
Je to jeden z dosud nejjasnějších signálů, že open source AI dohnala špičku v úlohách, na kterých vývojářům skutečně záleží. V tomto článku rozebereme, co Nex-N2-Pro je, co jeho benchmarkové skóre doopravdy znamenají, jak si stojí proti GPT-5.5 a Opus 4.7, kolik stojí a kdo by se jím vlastně měl zabývat. Věnujeme se i té části, kterou většina uvítacích příspěvků přeskakuje, a to je zcela reálný hardware potřebný ke spuštění modelu se 397 miliardami parametrů na vlastním počítači.
Permisivní licence jako Apache 2.0 je to, co dělá z Nex-N2-Pro skutečnou open source AI, kterou lze zdarma stáhnout, upravovat a provozovat na vlastním hardwaru.
Nex-N2-Pro se objevuje i v našem přehledu nejlepších open source AI modelů jako nejpermisivněji licencovaná agentní volba.
Hlavní poznatky
- Nex-N2-Pro je bezplatný a open source pod licencí Apache 2.0, vydaný Nex AGI dne 2. června 2026
- Jde o model Mixture-of-Experts s 397 miliardami parametrů, který aktivuje jen 17 miliard parametrů na token a je postavený na Qwen3.5-397B-A17B
- Mezi hlavní skóre patří 80,8 SWE-Bench Verified, 75,3 Terminal-Bench 2.1, 90,7 GPQA Diamond a 94,0 IFEval
- V programátorských a agentních benchmarcích drží krok s GPT-5.5 a Claude Opus 4.7, jako první open model takto přesvědčivě
- Menší sourozenec Nex-N2-mini cílí na slabší hardware, ale spuštění plného modelu Pro lokálně vyžaduje zhruba 794 GB VRAM v plné přesnosti
Co je Nex-N2-Pro?
Nex-N2-Pro je open source AI model od Nex AGI navržený spíše pro agentní práci než pro jednoduchý chat. Používá návrh Mixture-of-Experts (MoE) s 397 miliardami celkových parametrů, ale aktivuje jen 17 miliard na token, což udržuje inferenci mnohem levnější než u hustého modelu stejné velikosti. Přijímá jako vstup text i obrázky a vytváří textový výstup, přičemž podporuje kontextové okno 262 000 tokenů s výstupem až 256 000 tokenů.
Model je dotrénovaný na Qwen3.5-397B-A17B, otevřeném základovém modelu od Alibaby, takže dědí tuto linii a přidává navrch vlastní agentní trénink Nex AGI. Nex-N2-Pro je větší ze dvou vydání. Jeho sourozenec Nex-N2-mini je postavený na menším základu Qwen3.5-35B-A3B pro ty, kdo chtějí něco lehčího ke spuštění. Oba jsou otevřené pod licencí Apache 2.0, což znamená, že je můžete používat komerčně, upravovat a provozovat na vlastním serveru bez placení licenčního poplatku.
Pokud jste sledovali nedávná otevřená vydání, jako je přehled cen a modelů Qwen od Alibaby nebo MiniMax M3, Nex-N2-Pro zapadá do stejné vlny schopných, otevřeně licencovaných modelů. Rozdíl je v tom, jak agresivně cílí na agentní programování.
Benchmarky Nex-N2-Pro: Jak je vlastně dobrý?
Právě benchmarkový přehled je místem, kde si Nex-N2-Pro zaslouží pozornost. V úlohách softwarového inženýrství a agentních úlohách dosahuje čísel, která byla ještě donedávna výhradním územím uzavřených špičkových modelů. Následující údaje pocházejí z oficiální karty modelu na Hugging Face.
| Benchmark | Co měří | Nex-N2-Pro |
|---|---|---|
| SWE-Bench Verified | Skutečné opravy chyb na GitHubu | 80,8 |
| Terminal-Bench 2.1 | Úlohy příkazové řádky / agentů | 75,3 |
| SWE-Bench Pro | Náročnější softwarové inženýrství | 58,8 |
| GPQA Diamond | Vědecké uvažování na úrovni postgraduálu | 90,7 |
| IFEval | Dodržování instrukcí | 94,0 |
| BrowseComp | Prohlížení webu a rešerše | 83,7 |
| GDPval | Ekonomické úlohy s dlouhým horizontem | 1585 |
Vyniká 80,8 na SWE-Bench Verified, testu, který po modelu žádá, aby opravil skutečné chyby ve skutečných open source repozitářích. Skóre v pásmu kolem 80 znamená, že je model užitečný pro každodenní inženýrskou práci, ne jen pro ukázky. Také 94,0 na IFEval má význam pro tvůrce agentů, protože agent, který se uprostřed úlohy odchýlí od instrukcí, je horší než žádný agent.
Jak si Nex-N2-Pro stojí proti GPT-5.5 a Opus 4.7
Nex AGI staví model jako rovnocenného soupeře uzavřených lídrů a přímé porovnání čísel, která zveřejnila, to v programování potvrzuje. Nex-N2-Pro překonává GPT-5.5 na SWE-Bench Pro a poráží Claude Opus 4.7 na Terminal-Bench 2.1, zatímco za GPT-5.5 mírně zaostává v prohlížení webu.
| Benchmark | Nex-N2-Pro | GPT-5.5 | Opus 4.7 |
|---|---|---|---|
| Terminal-Bench 2.1 | 75,3 | N/A | 69,7 |
| SWE-Bench Pro | 58,8 | 58,6 | N/A |
| BrowseComp | 83,7 | 84,4 | 79,8 |
Poctivé čtení je, že Nex-N2-Pro je konkurenceschopný, ne dominantní. Vyměňuje si údery s nejlepšími uzavřenými modely v programování a agentní práci, o vlásek prohrává v některých úlohách prohlížení a výrazně vítězí v jedné metrice, kterou ostatní nemohou dorovnat, a tou je cena. Náš pohled na uzavřenou konkurenci si můžete přečíst v článku o Claude Opus a podívat se, kde model stojí, na našem rozcestníku nejlepších AI modelů.
Čím se „agentní myšlení“ liší
Nabídka Nex AGI se soustředí na rámec, který nazývá Agentic Thinking a který propojuje pochopení požadavku, plánování, psaní a spouštění kódu, čtení výsledku a iteraci do jedné souvislé smyčky. Většina modelů zachází s uvažováním, používáním nástrojů a prováděním jako se samostatnými kroky. Nex-N2-Pro je trénovaný tak, aby je udržel v jediném toku, což je blíž tomu, jak lidský inženýr skutečně řeší problém.
Pod tím leží dvě myšlenky. Adaptive Thinking nechává model sám rozhodnout, kdy uvažovat do hloubky a kdy jednat rychle, což podle Nex AGI snižuje počet myšlenkových tokenů o 30 až 50 procent u rutinních kroků. Coherent Thinking udržuje jeden konzistentní styl uvažování napříč různými typy úloh, takže se model nechová jako jiný systém, když přepne z rešerše na programování. Společně mají zajistit, aby byly dlouhé, vícekrokové úlohy spolehlivější, což je přesně to, kde se dnes většina agentů rozpadá.
Ceny a jak Nex-N2-Pro používat
Hlavní cena je ta snadná část. Protože je Nex-N2-Pro open source pod licencí Apache 2.0, jsou váhy zdarma ke stažení z Hugging Face a ModelScope. Během uvedení v červnu 2026 jej několik hostovaných poskytovatelů nabízelo také zdarma, včetně OpenRouter v jeho bezplatné verzi a SiliconFlow, který inzeroval bezplatný přístup na první dva týdny. Standardní placené sazby za token nebyly v době psaní veřejně zveřejněny, takže očekávejte, že se ustálí, jakmile skončí uváděcí akce.
Máte několik možností, jak jej vlastně používat. Nejrychlejší je přes hostované API, jako je OpenRouter, SiliconFlow, Novita nebo FriendliAI, kde odesíláte požadavky a nikdy se nedotknete GPU. Druhá je stažení vah a jejich spuštění vlastními silami pomocí nástrojů jako llama.cpp, Ollama nebo LM Studio. Třetí je vyhnout se žonglování s modely úplně, k čemuž se vracíme níže.
Háček: Lokálně jej pravděpodobně nespustíte
Tady je návrat k realitě, který většina zpravodajství o uvedení přechází. Model se 397 miliardami parametrů je obrovský a spuštění Nex-N2-Pro v plné přesnosti BF16 vyžaduje zhruba 794 GB VRAM, což je území datových center a daleko za možnostmi jakéhokoli jednotlivého spotřebitelského GPU. I stlačený na kvantizaci INT4 stále potřebuje kolem 216 GB VRAM, takže jediná karta s 24 GB, jako je RTX 4090, se ani zdaleka nepřibližuje.
Pro většinu lidí to znamená, že praktickou cestou je API, a varianta Nex-N2-mini je lepší volbou, pokud chcete něco, co se vejde na skromnější hardware. Pokud chcete jen tu schopnost bez starostí s infrastrukturou, nejjednodušší cestou je aplikace s více modely. Naše vlastní aplikace Fello AI vám dává Claude, ChatGPT, Gemini, Grok a DeepSeek přes jedno předplatné na Macu, takže získáte výstup na špičkové úrovni, aniž byste sami spravovali GPU, kvantizaci nebo účty u poskytovatelů.
Nex-N2-Pro versus konkurence
Kde tedy stojí proti poli soupeřů? Následující tabulka shrnuje kompromisy jednoduchými slovy.
| Model | Vývojář | Licence | Vynikající přednost | Nejlepší pro |
|---|---|---|---|---|
| Nex-N2-Pro | Nex AGI | Apache 2.0 (open) | Agentní programování a používání nástrojů | Bezplatný self-hosting, tvůrce agentů |
| GPT-5.5 | OpenAI | Proprietární | Všestranná kvalita a ekosystém | Běžní uživatelé, uhlazené aplikace |
| Claude Opus 4.7 | Anthropic | Proprietární | Hluboké uvažování a kvalita kódu | Profesionální vývojáři, dlouhé úlohy |
| Qwen3.5-397B | Alibaba | Otevřené váhy | Silný vícejazyčný základ | Tvůrci, kteří chtějí základový model |
| DeepSeek V4 | DeepSeek | Otevřené váhy | Nákladově efektivní uvažování | Cenově dostupná agentní a uvažovací práce |
Pokud potřebujete bezplatný model, který můžete hostovat a přizpůsobit vlastnímu agentnímu stacku, je Nex-N2-Pro nyní jednou z nejsilnějších možností na stole, po boku otevřených vydání jako Nemotron 3 Ultra od NVIDIA. Pokud chcete jen nejlepší odpověď s nulovým nastavováním, na pohodlí stále vítězí uzavřený model nebo aplikace s více modely.
Závěr
Nex-N2-Pro je skutečným milníkem pro open source AI. Bezplatný model Apache 2.0, který se v programátorských benchmarcích vyrovná GPT-5.5 a Claude Opus 4.7, by před rokem zněl přitaženě za vlasy, a dnes si jej můžete stáhnout. Pro kontext: nejnovější uzavřenou špičkou OpenAI je třívrstvý GPT-5.6 (Sol, Terra a Luna), který byl uveden jen pro vládou schválené partnery. Poctivou výhradou je hardware, protože spuštění plného modelu vyžaduje vážnou infrastrukturu, takže API nebo menší Nex-N2-mini budou pro většinu čtenářů reálným vstupním bodem.
Pokud stavíte agenty nebo píšete kód a chcete otevřený model, který máte pod kontrolou, začněte s hostovaným API na OpenRouter nebo SiliconFlow a otestujte jej na vlastních úlohách, než se pustíte do self-hostingu. Pokud byste raději nastavování přeskočili a volně přepínali mezi špičkovými modely, vyzkoušejte místo toho all-in-one aplikaci Fello AI.
FAQ
Je Nex-N2-Pro zdarma?
Ano. Nex-N2-Pro je open source pod licencí Apache 2.0, takže si můžete váhy zdarma stáhnout z Hugging Face nebo ModelScope. Několik hostitelů, včetně OpenRouter a SiliconFlow, také nabízelo bezplatný přístup k API během uvedení v červnu 2026.
Na čem je Nex-N2-Pro postavený?
Je dotrénovaný na Qwen3.5-397B-A17B, otevřeném základovém modelu od Alibaby. Nex AGI navrch přidala vlastní agentní trénink a vytvořila chování Agentic Thinking, kterým je model známý. Rio 3.5 Open 397B, vydaný městskou správou Rio de Janeira, je postavený na stejném základu Qwen.
Jak si Nex-N2-Pro stojí proti GPT-5.5?
V programování je vysoce konkurenceschopný. Nex-N2-Pro získává 75,3 na Terminal-Bench 2.1 a 58,8 na SWE-Bench Pro, mírně před GPT-5.5 v některých testech softwarového inženýrství, zatímco v prohlížení webu trochu zaostává. Velký rozdíl je v tom, že Nex-N2-Pro je otevřený a zdarma.
Můžu Nex-N2-Pro spustit na vlastním počítači?
Ne snadno. Plný model potřebuje kolem 794 GB VRAM v plné přesnosti a zhruba 216 GB i po kvantizaci na INT4, což je hluboko za možnostmi spotřebitelských GPU. Většina lidí by měla místo toho použít hostované API nebo lehčí Nex-N2-mini.
Jaký je rozdíl mezi Nex-N2-Pro a Nex-N2-mini?
Oba pocházejí od Nex AGI a sdílejí návrh Agentic Thinking. Nex-N2-Pro je větší model 397B postavený na Qwen3.5-397B-A17B, zatímco Nex-N2-mini je postavený na menším základu Qwen3.5-35B-A3B pro lehčí, dostupnější nasazení.