Aktualizováno v srpnu 2026

Nejlepší AI modely v roce 2026

Žebříčky, srovnání a podrobné analýzy, každý měsíc aktualizované, jakmile vyjdou nové modely.

Srpen 2026 začíná s Claude Opus 5 na vrcholu a dvěma korunami měnícími majitele. Opus 5 vede Intelligence Index od Artificial Analysis se skóre 61 a jeho Agentic Index se skóre 55,3 za $5 / $25 za 1M tokenů, poloviční cena oproti Claude Fable 5, a nyní převzal i programátorskou korunu poté, co skončil první na obou hlasovacích programátorských žebříčcích Areny. Druhý posun se odehrává na levném konci, kde DeepSeek V4-Flash 0731 dorazil 31. července jako nová volba s nejlepším poměrem cena/výkon za $0.14 / $0.28. Níže jsou vítězové kategorií pro srpen 2026. Klikněte na kteroukoli kartu a přejdete rovnou k úplnému rozboru, nebo použijte pevnou navigaci k přeskakování mezi kategoriemi. Žebříčky, benchmarky a ceny aktualizujeme do 48 hodin od každého většího uvedení modelu.

Vítězové kategorií za srpen 2026
Psaní
Claude Fable 5
#1 Arena text (1508.6) a Humanity's Last Exam
Jediný model v první trojce všech tří nezávislých žebříčků pro psaní, za $10 / $50.
Podrobná analýza →
Chat & každodenní asistent
GPT-5.6
Výchozí model ChatGPT od 9. července
Nejlepší asistent, kterého většina lidí skutečně otevře, s vyvážením schopností, rychlosti a dosahu.
Podrobná analýza →
Obrázky
ChatGPT Images 2.0
#1 v generování obrázků z textu i v úpravách obrázků
Vede oba nezávislé žebříčky obrázků a stále nejlepší v čitelném vícejazyčném textu.
Podrobná analýza →
Video
Gemini Omni Flash
#1 na obou video žebříčcích (1527 Arena)
Vede oba nezávislé video žebříčky s konverzačními úpravami za zhruba $0.10 za sekundu.
Podrobná analýza →
Programování
Claude Opus 5
#1 Arena WebDev (1,702.9) za $5 / $25
Přebírá programátorskou korunu na hlasovacích žebříčcích, za poloviční cenu oproti Claude Fable 5.
Podrobná analýza →
Kreativita
Grok 4.5
Nejméně obsahových omezení + nativní X v reálném čase
Volba pro odvážnou, trendovou práci: nejméně mantinelů a nativní integrace X.
Podrobná analýza →
Přesnost & výzkum
Gemini 3.1 Pro
98 % ARC-AGI-1 za $0.52 na úlohu
Vyrovnává lidský panel na ARC-AGI-1 s nativním ukotvením ve vyhledávání Google pro živé odpovědi.
Podrobná analýza →
Řešení problémů
GPT-5.6 Sol
#1 LiveBench Mathematics, Reasoning a ARC-AGI-2
Nejlépe podložená koruna na této stránce pro nejtěžší matematiku, vědu a uvažování.
Podrobná analýza →
AI agenti
Gemini Spark
První AI agent běžící v cloudu 24/7
Běží nepřetržitě v Google Cloud VM, hluboce integrovaný s Gmailem, Docs a Chromem.
Podrobná analýza →
Co je nového v srpnu 2026
5. srp. Meta Muse Spark 1.2 a Muse Code, Intelligence Index z 51 na 54 při nezměněných $1.25 / $4.25, plus terminálový programátorský agent Nové
Meta vydala Muse Spark 1.2 dne 5. srpna 2026 spolu s Muse Code, svým prvním terminálovým programátorským agentem, který běží na macOS a Linuxu bez desktopové aplikace a bez předplatného. Artificial Analysis hodnotí model na Intelligence Index 54 při nejvyšším nastavení uvažování, oproti 51 u verze 1.1 a 43 u dubnového vydání, a téměř celý tento nárůst je agentický, nikoli obecné znalosti; jeho GDPval-AA v2 Elo skočilo z 1371 na 1631, zatímco Terminal-Bench v2.1 se posunul jen z 78 % na 80 %. Ceny zůstávají nezměněny na $1.25 / $4.25 za 1M tokenů při kontextovém okně 1M tokenů a Meta přidala úroveň Contributor za $0.10 / $0.20, zhruba o 92 % levněji, výměnou za to, že Meta smí trénovat na vašich promptech a completions. Dostupnost se rozšířila z náhledu pouze pro USA, pod nímž vyšla verze 1.1, na rozšířený globální přístup přes Muse Code, Meta Model API a OpenRouter. Na vlastních uváděcích grafech Mety končí model druhý za Claude Opus 5 na všech třech zveřejněných programátorských benchmarcích, se skóre 82,9 % proti 86,7 % na Terminal-Bench 2.1.
3. srp. Alibaba Qwen 3.8 (Qwen3.8-Max), multimodální vlajkový model s 2,4 biliony parametrů nyní obecně dostupný za $2 / $6 Nové
Alibaba zpřístupnila Qwen3.8-Max obecně dne 3. srpna 2026, dva týdny po náhledu na WAIC Shanghai, a každé číslo, které při náhledu chybělo, má nyní hodnotu. Běží s 2,4 biliony celkových parametrů a zhruba 95 miliardami aktivních na token na řídkém návrhu Mixture-of-Experts, přijímá text, obrázky a video a potvrzuje kontextové okno 1M tokenů s až 128K výstupními tokeny. Ceny API jsou $2 / $6 za 1M tokenů, ploché napříč celým kontextem místo odstupňování podle délky promptu, s cache reads za $0.25. Tvrzení „druhý hned za Fable 5" se nyní čistě rozpadá na dvě části: na žebříčku vision Areny je #2 se skóre 1305, hned za Fable 5, ale na textovém žebříčku je #5 se skóre 1496, za čtyřmi záznamy Anthropicu. Obě skóre Areny jsou stále označena jako předběžná a slíbené open weights nevyšly. Qwen 3.8 držíme mimo hodnocené volby, dokud váhy a licence skutečně nedorazí.
31. čvc. DeepSeek DeepSeek V4-Flash 0731, stejná cena, stejná velikost, Intelligence Index z 40 na 50 Nové
DeepSeek znovu dotrénoval V4-Flash a výsledek zveřejnil 31. července 2026 jako DeepSeek-V4-Flash-0731. Na tvaru modelu se nic nezměnilo: je to stejný Mixture-of-Experts s 284B celkem / 13B aktivními, stejný kontext 1M tokenů, stejná licence MIT a stejných $0.14 / $0.28 za 1M tokenů na vlastním ceníku DeepSeeku. Co se pohnulo, jsou schopnosti. Artificial Analysis jej nyní hodnotí na Intelligence Index 50, oproti 40, s Agentic 45,7 a 78,7 % na Terminal-Bench v2.1, což jej zvedá zhruba ze třináctého na třetí místo v otevřeném poli za Kimi K3 a GLM-5.2. Za $0.03 na indexovou úlohu je to nejlevnější údaj na celém žebříčku Artificial Analysis, a to je to, co tento měsíc posunulo naši volbu s nejlepším poměrem cena/výkon. Jedno upřímné omezení: skóre je den staré, pochází od jediné firmy a model zatím nemá hlasy na žádném žebříčku Areny.
31. čvc. MiniMax MiniMax H3, 2K video s nativním stereo zvukem od $0.13 za sekundu Nové
MiniMax uvedl H3 (Hailuo 3.0) dne 31. července 2026 jako univerzální multimodální video model, který přijímá text, obrázek, video a zvuk jako vstup. Vydává 2K klipy o délce 4 až 15 sekund s nativním stereo zvukem, podporuje přenos pohybu, generování řízené referencí a generativní úpravy videa a účtuje se za sekundu za $0.13 pro 2K a $0.09 pro 768p. Artificial Analysis jej řadí na #2 na svém video žebříčku se skóre 1241,5, o 3,3 Elo za Gemini Omni Flash. Video korunu jsme ponechali tam, kde je: ten odstup je den starý a pochází od jediného žebříčku, který se mezi analýzami nereprodukoval, a hranice Areny pro generování videa z textu předchází H3 celá, takže na hlasech nic neporazil. MiniMax slíbil váhy začátkem srpna a v době, kdy tato aktualizace vyšla, zveřejněny nebyly.
Konec čvc. Thinking Machines Inkling Small, čtvrtina velikosti Inkling při téměř stejném skóre Nové
Thinking Machines navázali na svůj první open-weight model modelem Inkling Small, Mixture-of-Experts s 276B celkem / 12B aktivními pod Apache 2.0, který směruje každý token k 6 z 256 expertů plus 2 sdíleným. Přijímá text, obrázek a zvuk na vstupu a vrací text a Artificial Analysis jej hodnotí na Intelligence Index 40 proti 41 pro plnohodnotný Inkling, při zhruba čtvrtině parametrů. Zdroje se neshodují na přesném datu vydání, takže žádné neuvádíme. Váhy, sestavení NVFP4 a recepty na nasazení jsou všechny na Hugging Face.
30. čvc. OpenAI Snížení cen GPT-5.6, Luna o 80 % levnější, Terra o 20 % levnější, Sol beze změny
OpenAI snížil 30. července 2026 cenu API u svých dvou levnějších úrovní GPT-5.6, tři týdny poté, co rodina dosáhla obecné dostupnosti. Luna klesla o 80 % na $0.20 / $1.20 za 1M tokenů a Terra klesla o 20 % na $2 / $12, přičemž cache input reads klesly na $0.02 u Luny a $0.20 u Terry. Vlajkový Sol zůstává na $5 / $30, prompty nad 272K vstupních tokenů se stále účtují za 2násobek vstupu a 1,5násobek výstupu a žádná cena předplatného ChatGPT se nezměnila, takže Free, Go za $8, Plus za $20, Pro za $100 a $200 a Business za $25-30 na místo zůstávají všechny beze změny. Snížení nechává Lunu na Intelligence Index 51 na Artificial Analysis za zhruba $0.07 na indexovou úlohu, o bod výše než Gemini 3.6 Flash ve skóre a hluboko pod jeho $0.56 na úlohu.
24. čvc. Anthropic Claude Opus 5, nová #1 na Artificial Analysis, vede jak Intelligence Index (61), tak Agentic Index (55.3) Nové
Anthropic vydal Claude Opus 5 dne 24. července 2026, svůj čtvrtý model za necelé dva měsíce po Mythos 5, Fable 5 a Sonnet 5. Na přepočítaném žebříčku v4.1 od Artificial Analysis je nyní celkově nejlépe hodnoceným modelem, vede jak Intelligence Index se skóre 61, tak Agentic Index se skóre 55,3, před Fable 5 (60 / 52,8) a GPT-5.6 Sol (59 / 54,0). Ceny API jsou $5 / $25 za 1M tokenů, shodné s Opus 4.8 a poloviční oproti Fable 5, pod API id claude-opus-5. Přidává režim Fast, který běží zhruba 2,5krát rychleji za dvojnásobek základní ceny, plus nastavení effort od low do high a novou úroveň max. Bere si také naprosto žebříček GDPval-AA v2 pro profesionální výstupy od Artificial Analysis se skóre 1858, před 1746 od Fable 5. Arena jej od té doby ohodnotila napříč svými žebříčky a řadí jej na #1 ve WebDev, image-to-WebDev, Document a na žebříčku Agent a na #6 v textu, což mu tento měsíc přisoudilo programátorskou korunu. Je výchozím modelem v Claude Max a nejsilnější v Claude Pro.
24. čvc. Sakana AI Fugu-Ultra v1.1, obnova orchestrační engine se zlepšeními hlášenými dodavatelem až o 7,9 bodu oproti v1.0 za stejnou cenu Nové
Sakana AI dodala Fugu-Ultra v1.1 dne 24. července 2026, obnovu frontier modelů uvnitř své orchestrační engine TRINITY, nikoli nový základní model. Vlastní oznámení Sakany tvrdí zlepšení až o 7,9 bodu oproti v1.0 při nezměněné ceně, ale skóre v1.0 vedle toho nezveřejňuje, takže to berte jako údaj dodavatele. Všechna čísla benchmarků pocházejí z vlastního scaffoldingu Sakany, nikoli z nezávislého testování: na vlastních grafech vede před Opus 4.8, GPT-5.5 a Gemini 3.1 Pro, se skóre 73,7 % na SWE-Bench Pro, 82,1 % na Terminal-Bench 2.1, 93,2 % na LiveCodeBench a 95,5 na GPQA-Diamond. Pole ale nezametá: jeho 50,0 na Humanity's Last Exam je remíza v rámci zaokrouhlení s 49,8 u Opus 4.8. Cena je nezměněná oproti v1.0 na $5 / $30 za 1M vstupních/výstupních tokenů (plus $0.50 cached) a stoupá na $10 / $45 nad hranicí kontextu 272K tokenů; API je kompatibilní s OpenAI s kontextovým oknem 1M tokenů.
21. čvc. Google Gemini 3.6 Flash, levnější výstup, rychlejší, stejný Intelligence Index
Gemini 3.6 Flash je nejnovější model Flash od Googlu a ten, k němuž nyní dosáhne bezplatná aplikace Gemini. Výstup klesá na $7.50 za 1M tokenů z $9.00, zatímco vstup zůstává na $1.50, takže snížení je pouze na výstupu. Google říká, že „snižuje spotřebu výstupních tokenů o 17 % oproti 3.5 Flash" a až o 65 % u dlouhodobé agentické práce jako DeepSWE, takže reálná úspora na úlohu je větší než cenovka. Artificial Analysis hodnotí 3.6 Flash i 3.5 Flash na stejném Intelligence Index 50 na v4.1, takže to berte jako levnější a rychlejší, nikoli chytřejší. Vyšel spolu s Gemini 3.5 Flash-Lite za $0.30 / $2.50 a je živý přes Gemini API v Google AI Studio a Android Studio, na Gemini Enterprise Agent Platform a v aplikaci Gemini pro všechny. Google také oznámil Gemini 3.5 Flash Cyber, ale ten nevyšel: míří přes CodeMender jako pilot s omezeným přístupem k vládám a důvěryhodným partnerům.
16. čvc. Moonshot AI Kimi K3, 2,8B parametrů, největší kdy vydaný open-weight model (váhy vyšly 27. července) Nové
Moonshot AI uvedl Kimi K3 v předvečer 16. července 2026, svůj nový vlajkový model a nástupce řady K2, a poté 27. července 2026 zveřejnil kompletní open weights. Karta modelu na Hugging Face potvrzuje návrh Mixture-of-Experts s 2,8 biliony parametrů, 104 miliardami aktivních na token, kontextovým oknem 1 048 576 tokenů a vstupem textu, obrázku a videa (bez zvuku). Uvažování je vždy zapnuté a reasoning_effort nyní přijímá low, high nebo max, s max jako výchozí hodnotou. Artificial Analysis řadí K3 na Intelligence Index 57, nejvyšší ze všech open-weight modelů, a na Areně je #3 na žebříčku Agent a #2 ve WebDev za Claude Opus 5. Oficiální ceny API jsou $3 / $15 za 1M tokenů s cache input za $0.30, plus $0.005 za každé úspěšné volání vyhledávání na webu. Ke stažení je 96 shardů safetensors a zhruba 1,56 TB pod vlastní licencí Kimi K3 License místo MIT, takže self-hosting je vícenodová záležitost; bezplatná základní chatovací úroveň existuje v aplikaci Kimi, přičemž náročnější agentické použití je měřeno na placených plánech.
9. čvc. OpenAI GPT-5.6 Sol, Terra a Luna, rodina nové generace živá napříč ChatGPT, Codex a API
OpenAI otevřel svou rodinu GPT-5.6 obecné dostupnosti dne 9. července 2026 a ukončil tím dvoutýdenní uzavřený náhled, který začal 26. června za bezpečnostní prověrkou vlády USA. Řada sahá od nejméně po nejschopnější: Luna, rychlá a nízkonákladová úroveň; Terra, vyvážený každodenní model, o němž OpenAI říká, že se vyrovná GPT-5.5 zhruba za poloviční cenu; a Sol, vlajkový model laděný pro biologii, chemii a kyberbezpečnost. GPT-5.6 se nyní zavádí napříč ChatGPT, Codex a API jako výchozí model OpenAI, s uváděcími cenami API Sol $5 / $30, Terra $2.50 / $15 a Luna $1 / $6 za 1M tokenů; Terra a Luna byly 30. července 2026 sníženy na $2 / $12 a $0.20 / $1.20. Na těch několika benchmarcích, které OpenAI zveřejnil, Sol dosahuje 88,8 % na Terminal-Bench 2.1 (91,9 % ve výpočetně náročnějším režimu „ultra") oproti 88,0 % u GPT-5.5 a 60,5 na HealthBench Professional; OpenAI nápadně zadržel obvyklá čísla SWE-bench Verified, GPQA a FrontierMath a jeho kontextové okno stále není oficiálně zveřejněno. Jedna výhrada: vlastní system card OpenAI a externí hodnotitel METR upozornili na zvýšené chování „scheming" u Sol, včetně obcházení softwarově-inženýrského testu nejvyšší mírou, jakou kdy METR zaznamenal.
Čeká se Google Gemini 3.5 Pro, stále nevydaný, měsíce za plánem podle Bloombergu Zpožděno
Gemini 3.5 Pro zůstává největším čekajícím uvedením. Google jej oznámil na I/O dne 19. května spolu s Gemini 3.5 Flash, ale vyšel jen Flash a červnový cíl padl. Bloomberg 16. července 2026 informoval, že model je měsíce za plánem a nedosáhl interních cílů Googlu, přičemž společnost stále pracuje na zlepšení jeho schopností zejména v programování. To je celý podložený obraz. Google nikdy veřejně nepotvrdil datum uvedení a Google nezveřejnil finální specifikace jako kontextové okno nebo režimy uvažování, takže kolující čísla berte jako nepotvrzená. Mezitím používejte Gemini 3.6 Flash; 3.5 Pro přesuneme do hlavního žebříčku ve chvíli, kdy vyjde.
Volba kategorie, srpen 2026

Nejlepší AI na psaní

1
Claude Fable 5
Nejlepší psaní celkově
2
Kimi K3
Tvůrčí beletrie
3
Claude Sonnet 5
Zdarma na každý den

Nejlepší AI na psaní je Claude Fable 5, jediný model v první trojce všech tří nezávislých žebříčků pro psaní, s Claude Sonnet 5 jako volbou s nejlepším poměrem cena/výkon v bezplatné verzi a GPT-5.5 jako alternativou pro faktograficky ukotvené obchodní psaní. Fable 5 vede žebříček tvůrčího psaní Areny, kraluje LiveBench Language se skóre 90,7 a je třetí na EQ-Bench Creative Writing v3 za Kimi K3 a GPT-5.6 Sol. Žádný jiný model není v první trojce na více než jednom z nich. Je to změna oproti minulému měsíci, kdy tuto pozici držel Claude Sonnet 5 na GDPval-AA; preferenční žebříčky toto umístění nepodporují, takže Sonnet 5 je nyní volba s nejlepším poměrem cena/výkon, nikoli lídr kvality. Fable 5 stojí $10 / $50 za 1M tokenů a je trvale zahrnutý v Claude Max a Team Premium zhruba na 50 % běžných limitů použití. Pokud je vaše psaní pracovní výstup, a ne próza, Claude Opus 5 kraluje žebříčku GDPval-AA v2 pro profesionální výstupy od Artificial Analysis se skóre 1858, výrazně před 1746 od Fable 5.

ModelNejlepší proSilná stránkaSlabinaCena (za 1M tokenů)
Claude Fable 5Nejlepší psaní celkově#1 Arena text celkově (1508.6), #1 LiveBench Language (90.7), #3 EQ-BenchNejdražší volba zde$10 / $50
Kimi K3Tvůrčí beletrie a hlas#1 EQ-Bench Creative Writing (2377), 234 Elo náskok před druhýmJen #10 na Arena tvůrčí psaní$3 / $15
Claude Sonnet 5Bezplatné psaní na každý denZdarma a výchozí na claude.ai, 1M kontext#53 Arena tvůrčí psaní; 75,0 LiveBench Language$2 / $10 úvodní (poté $3 / $15)
Claude Opus 5Profesionální výstupy#1 GDPval-AA v2 se skóre 1858, před Fable 5 (1746)Za Fable 5 na Arena text a Humanity's Last Exam$5 / $25
GPT-5.5Faktograficky ukotvené obchodní psaníDoložené zlepšení faktografické spolehlivosti oproti GPT-5.4Úrovně uvažování nyní označeny jako zastaralé$5 / $30
Gemini 3.6 FlashHromadné koncepty ve velkémO 17 % méně výstupních tokenů než 3.5 FlashSlabší v nejtěžším uvažování$1.50 / $7.50
Druhé místo a alternativy: Kimi K3 je druhý pro tvůrčí beletrii a vyhrává EQ-Bench naprosto, Claude Sonnet 5 je druhý v poměru cena/výkon a ten, který použít, pokud neplatíte, Claude Opus 5 je volba pro profesionální výstupy a Gemini 3.6 Flash je volba pro hromadné psaní konceptů.
Co se tento měsíc změnilo

Koruna za psaní zůstává u Claude Fable 5 a je to nejlépe podložené rozhodnutí na stránce. Fable 5 je nyní #1 na textovém žebříčku Areny se skóre 1508.6 k datu 1. srpna, #1 na Humanity's Last Exam se skóre 53,3 % a #1 na AA-Omniscience se skóre 40, což jsou tři různé firmy, které se shodují. Claude Opus 5 si drží dráhu profesionálních výstupů na GDPval-AA v2, kde přepočítaný žebříček nyní čte 1858 proti 1746 od Fable 5.

Volba kategorie, srpen 2026

Nejlepší AI pro chat & každodenního asistenta

1
GPT-5.6
Výchozí model ChatGPT
2
Claude Fable 5
Nejlépe hodnocený
3
Claude Opus 5
Promyšlená hloubka

Nejlepší AI pro každodenní chat je GPT-5.6 a upřímným důvodem je dosah, ne pozice na žebříčku. Je to model, který ChatGPT ve výchozím nastavení nabízí největší uživatelské základně v kategorii, což z něj dělá nejlepšího asistenta, kterého většina lidí skutečně otevře. V čisté lidské preferenci lídrem není: GPT-5.6 Sol sedí na #14 na textovém žebříčku Areny se skóre 1482,8, kde Claude Fable 5 vede se skóre 1508.6. Většina uživatelů ChatGPT dostane vyváženou úroveň Terra, o níž OpenAI říká, že se vyrovná GPT-5.5, a od snížení cen 30. července 2026 stojí o 60 % méně. Je dostupný v ChatGPT (zdarma s limity, Plus za $20/měsíc, Pro za $100/měsíc), přes API (Luna $0.20 / $1.20, Terra $2 / $12, Sol $5 / $30 za 1M tokenů) a zabalený uvnitř Fello AI vedle Claude, Gemini, Grok a DeepSeek. Jedna výhrada: system card OpenAI a hodnotitel METR upozornili na zvýšené chování „scheming" u Sol, takže GPT-5.5 Instant zůstává bezpečnější volbou pro práci citlivou na halucinace.

ModelNejlepší proSilná stránkaSlabinaCena
GPT-5.6Každodenní chat, výchozí model ChatGPTAsistent, kterého většina otevře; Terra se vyrovná GPT-5.5 za ~poloviční cenu#14 na Arena text; scheming označen METRZdarma / $20/měs. Plus; API $0.20 / $1.20 až $5 / $30
Claude Fable 5Nejlépe hodnocená konverzace#1 na Arena text celkově (1508.6) a v 6 ze 7 podkategoriíŽádná bezplatná verze; přístup přes kredity použití na Pro$10 / $50 API
Claude Opus 5Promyšlené, jemné odpovědi#1 Artificial Analysis Intelligence Index (61) a Agentic Index (55.3)#6 na Arena text, za Claude Fable 5$20/měs. Pro, $5 / $25 API
GPT-5.5 InstantKaždodenní práce citlivá na halucinaceO 52,5 % méně halucinovaných tvrzení vs. 5.3 InstantÚrovně uvažování nyní označeny jako zastaralé$20/měs. Plus; API $5 / $30
Gemini 3.6 FlashRychlý, zdarma, multimodálníZdarma v aplikaci Gemini, 1M kontext, #12 na Arena textSlabší v nejtěžším uvažováníZdarma / $1.50 / $7.50 API
Fello AIVšechny top modely, jedna aplikaceChatGPT + Claude + Gemini + Grok + DeepSeek a další na Macu, iPhonu a iPaduSměrováno přes aplikaci, ne přímo$9.99/měs.
Druhé místo a alternativy: Claude Fable 5 je druhý a skutečný lídr preferencí, Claude Opus 5 je druhý pro promyšlené každodenní použití, Gemini 3.6 Flash je druhý pro rychlý a zdarma a Grok 4.5 je nika pro dny s živými zprávami. Fello AI je přirozená volba, pokud chcete top modely v jedné aplikaci pro Mac a iOS za $9.99/měsíc místo žonglování s předplatnými.
Co se tento měsíc změnilo

GPT-5.6 si drží volbu pro chat díky dosahu a odstup od lídra preferencí se spíše zvětšil, než uzavřel. K datu 1. srpna sedí Sol na #14 na Arena text se skóre 1482,8, dolů z #11, zatímco Claude Fable 5 vede se skóre 1508.6. Na produktu se nic nezměnilo, takže se koruna nehýbe: stále jde o to, kterého asistenta většina lidí skutečně otevře.

Volba kategorie, srpen 2026

Nejlepší AI na obrázky

1
ChatGPT Images 2.0
Text v obrázcích
2
Reve 2.1
Rozvržení & 4K
3
Muse Image
Úpravy obrázků

Nejlepší AI na generování obrázků je ChatGPT Images 2.0 a je to nejméně sporná koruna na této stránce. GPT Image 2 vede žebříček generování obrázků z textu Areny se skóre 1385 Elo a její žebříček úprav obrázků se skóre 1463 a Artificial Analysis jej řadí na první místo na své vlastní obrázkové aréně se skóre 1339,4. Je to přirozená volba, kdykoli má váš obrázek obsahovat čitelná slova, v češtině nebo v jiném písmu, a je zahrnutý v ChatGPT Plus a Pro. Druhá místa se změnila. Reve 2.1 (9. července) je skutečná #2 v generování obrázků z textu se skóre 1302 a Reve 2.0 nyní sedí za ní na obou žebříčcích. Muse Image od Mety je #3 na žebříčku generování obrázků z textu Areny a #2 v úpravách obrázků, nejsilnější výsledek, jaký kdy nějaký obrázkový model Mety zvládl. Nano Banana Pro od Googlu už není druhý celkově: v generování obrázků z textu se řadí mezi #8 a #11, pod svého vlastního levnějšího sourozence Nano Banana 2, ačkoli v úpravách obrázků se umísťuje výše.

ModelNejlepší proSilná stránkaSlabinaCena
ChatGPT Images 2.0Obrázky s čitelným textem#1 generování obrázků z textu (1385) a #1 úpravy obrázků (1463)Méně fotorealistický než obrázková řada GeminiZahrnuto v ChatGPT Plus
Reve 2.1Rozvržení, typografie, nativní 4K#2 generování obrázků z textu se skóre 1302, úpravy zachovávající rozvrženíMenší ekosystémZdarma / od $7.99/měs.
Muse ImageÚpravy obrázků, ekosystém Meta#3 generování obrázků z textu, #2 úpravy obrázků (1407)Nové, tenké nástroje kolemAplikace Meta AI
Nano Banana 2 (Gemini 3.1 Flash Image)Fotorealistické portréty a produktyPředčí Nano Banana Pro na obou žebříčcíchSlabší v textu v obrázkuAplikace Gemini / AI Studio
Seedream 5.0 ProVícejazyčný text + úpravy oblastí10+ jazyků včetně arabštiny RTL, laso a vrstvové úpravyŽádné nezávislé benchmarky; nejistota kolem autorských právBytePlus / Magnific
Midjourney v8Stylizované umění, ilustraceEstetický základ, který většina umělců preferujeSlabší v textu v obrázku$10-$120/měs.
Grok ImagineNSFW / Spicy ModeNejvolnější mantinelyMenší model za tím$30/měs. SuperGrok
Druhé místo a alternativy: Reve 2.1 je druhý celkově a volba pro rozvržení a typografii, Muse Image je druhý pro úpravu obrázku, který již máte, a Nano Banana 2 je fotorealistická volba. Grok Imagine je stále jediný frontier model, který umožňuje obsah pro dospělé v režimu Spicy Mode.
Co se tento měsíc změnilo

Obrázková koruna je beze změny a GPT Image 2 stále vede všechny tři žebříčky, které sledujeme, na Arena generování obrázků z textu (1385), Arena úpravy obrázků (1463) a obrázkové aréně Artificial Analysis (1339,4). Jediným přírůstkem je MAI-Image-2.5 od Microsoftu, který sedí třetí na obrázkovém žebříčku Artificial Analysis se skóre 1269,7 a třetí na žebříčku úprav obrázků Areny, takže třetí místo nyní závisí na tom, kterou firmu čtete.

Volba kategorie, srpen 2026

Nejlepší AI na video

1
Gemini Omni Flash
#1 na obou video žebříčcích
2
MiniMax H3
2K + nativní zvuk
3
Dreamina Seedance 2.0
Nejbližší vyzyvatel

Nejlepší AI na generování videa je Gemini Omni Flash, který vede žebříček generování videa z textu Areny se skóre 1527 Elo, celých 45 bodů před druhým místem, a také kraluje video aréně Artificial Analysis. Je #1 u obou firem, což žádný jiný video model nezvládne. Ceny běží $1.50 na vstupu a $17.50 za 1M video výstupních tokenů, což vychází zhruba na $0.10 za sekundu hotového videa, a podporuje konverzační úpravy. Jediný skutečný limit je délka: Omni Flash generuje 10sekundové klipy. Pokud potřebujete delší záběry, Veo 3.1 zůstává správným nástrojem v aplikaci Gemini, AI Studio a Vertex AI, s nativním zvukem a výstupem 1080p. Tímto se nahrazuje Veo 3.1 na vrcholu kategorie; Veo 3.1 je dobrý model, ale ne vedoucí, s jeho nejlepší variantou na #6 na žebříčku generování videa z textu Areny. Kandidát, kterého sledovat, je MiniMax H3 (31. července), který generuje 2K klipy o délce 4 až 15 sekund s nativním stereo zvukem a účtuje se za sekundu od $0.13 při 2K, už #2 na video žebříčku Artificial Analysis se skóre 1241,5. Korunu kvůli tomu nehýbeme: skóre je den staré, pochází od jediného žebříčku, který se mezi analýzami nereprodukoval, a hlasovací hranice Areny pro generování videa z textu předchází H3.

ModelNejlepší proSilná stránkaSlabinaCena
Gemini Omni FlashNejlepší AI video celkově#1 na obou video žebříčcích (1527 Arena), konverzační úpravyOmezeno na 10sekundové generování~$0.10/sek.; aplikace Gemini / AI Studio
MiniMax H32K klipy s nativním zvukem4-15 s při 2K, nativní stereo zvuk; #2 na AA video (1241.5)Den staré, zatím žádné hlasy Areny; váhy nezveřejněny$0.13/sek. při 2K
Dreamina Seedance 2.0Nejbližší vyzyvatel#2 generování videa z textu (1482) a #1 v generování videa z obrázkuEkosystém ByteDance, omezený západní přístupDreamina / BytePlus
Muse VideoVideo v ekosystému Meta#3 generování videa z textu se skóre 1459Nejnovější ze skupiny, tenké nástrojeAplikace Meta AI
Veo 3.1Delší produkční klipyNativní zvuk, 1080p, silná fyzikální konzistence#6 na Arena video, ne lídr kvalityGoogle AI Pro / Ultra
Kling 3.0 / 3.0 TurboRychlá iterace za nižší cenuNativní 4K, 60fps, 15sekundové klipy; Turbo vyšel 17. červnaMimo top 16 na Arena generování videa z textuOd $10/měs.
Luma Ray 3Fotorealistické scénySilný realismus pro krajinyMenší komunitaZdarma / od $9.99/měs.
Druhé místo a alternativy: Dreamina Seedance 2.0 je druhá celkově a Omni Flash vlastně poráží v generování videa z obrázku, Muse Video je třetí a Veo 3.1 je volba, když 10 sekund nestačí. OpenAI 26. dubna 2026 zrušil spotřebitelskou aplikaci Sora 2 a zůstává jen vývojářské API, do 24. září 2026.
Co se tento měsíc změnilo

Gemini Omni Flash si drží video korunu a je stále #1 na obou žebříčcích, se skóre 1527,5 na Areně a 1244,8 na Artificial Analysis. MiniMax H3 (31. července) vstupuje jako kandidát na #2 na video žebříčku Artificial Analysis (1241,5), o 3,3 Elo zpět, a poráží Omni Flash ve specifikaci s výstupem 2K, klipy až 15 sekund a nativním stereo zvukem. Korunu držíme, protože ten odstup je den starý, jednožebříčkový a nenese žádné hlasy na Areně, jejíž hranice pro generování videa z textu předchází uvedení.

Volba kategorie, srpen 2026

Nejlepší AI na programování

1
Claude Opus 5
#1 Arena WebDev
2
Claude Fable 5
Nejtěžší dlouhodobé úlohy
3
Kimi K3
Webové aplikace a agenti

Nejlepší AI na programování je Claude Opus 5 a vyhrává na obou žebříčcích, kde vývojáři hlasují o hotovém výsledku, spíše než skript měří harness. Je #1 na žebříčku WebDev Areny se skóre 1,702.9 a #1 v image-to-WebDev se skóre 1,668.6, k hlasovacím hranicím 1. srpna a 31. července. Cena je druhou polovinou argumentu: Opus 5 běží $5 / $25 za 1M tokenů proti $10 / $50 u Claude Fable 5 a Artificial Analysis jej měří na $2.34 na indexovou úlohu proti $3.15 u Fable 5. Vlastní dokumentace Anthropicu vývojářům radí začít s Opus 5 pro komplexní agentické programování a rezervovat Fable 5 pro zátěže, které vyžadují nejvyšší dostupné schopnosti. Claude Fable 5 je druhý a zůstává volbou pro nejtěžší dlouhodobé úlohy, na #4 ve WebDev (1,630.7) a #2 v image-to-WebDev (1,625.7). Kandidátem je Kimi K3, který bere #2 ve WebDev se skóre 1,675.5 a #3 na žebříčku Agent Areny, nejsilnější open-weight kodér na žebříčcích, ačkoli self-hosting znamená 1,56 TB vah. Na Coding Index od Artificial Analysis to není zametení Claudem: GPT-5.6 Sol (xhigh) vede se skóre 78,3 s Opus 5 (max) na 78,0, dost blízko na remízu. Nejlevnějším seriózním kandidátem je nyní DeepSeek V4-Flash 0731 za $0.14 / $0.28.

ModelNejlepší proSilná stránkaSlabinaCena (za 1M tokenů)
Claude Opus 5Nejlepší programování celkově#1 Arena WebDev (1,702.9) a #1 image-to-WebDev (1,668.6); $2.34 na indexovou úlohuArtificial Analysis Coding Index má GPT-5.6 Sol o kousek napřed$5 / $25
Claude Fable 5Nejtěžší agentické dlouhodobé úlohy#2 Arena image-to-WebDev (1,625.7), #4 WebDev; 1M kontextNejdražší; Artificial Analysis Coding Index jej řadí sedmý$10 / $50
Kimi K3Stavba webových aplikací a agenti#2 Arena WebDev (1,675.5), #3 Arena Agent, nejvyšší otevřený Intelligence Index (57)1,56 TB pro self-hosting$3 / $15
GPT-5.6 SolVlajkový model OpenAI, agentické programování#1 Artificial Analysis Coding Index se skóre 78,3 (xhigh)Chybí na oficiálním žebříčku Terminal-Bench; eval-gaming označen METR$5 / $30
Muse Spark 1.2Levné agentické programováníIntelligence Index 54 za $1.25 / $4.25; 80 % na Terminal-Bench 2.1 (Artificial Analysis)Druhý za Opus 5 na všech třech vlastních programátorských grafech Mety (82,9 % vs. 86,7 %); Scale SEAL ohodnotil jen 1.1$1.25 / $4.25
Grok 4.5Levný kodér s dobrým poměrem cena/výkon#4 na oficiálním žebříčku Terminal-Bench 2.1 se skóre 79,3 % přes Cursor CLIVyšší míra halucinací; konzole API pro EU stále zavřená$2 / $6
Gemini 3.6 FlashAgentické programování ve velkémIntelligence Index 50, o 17 % méně výstupních tokenů než 3.5 FlashSlabší v nejtěžším uvažování$1.50 / $7.50
GLM-5.2Nejlepší open-weight kodér, který si můžete hostitIntelligence Index 51, #6 Arena WebDev (1,587.1), licence MITKimi K3 jej předčí; jen self-host nebo poskytovatelOpen weights (MIT)
Druhé místo a alternativy: Kimi K3 je druhý na žebříčku WebDev Areny a volba, pokud chcete nejsilnější open weights, Claude Fable 5 je druhý pro nejtěžší dlouhodobé úlohy, GPT-5.6 Sol je druhý na kompozitu Artificial Analysis a GLM-5.2 je open-weight volba pro týmy, které si jej hostí samy. Uvnitř IDE je Cursor s Claudem stále nejoblíbenější kombinací a Claude Code je přirozená volba, pokud žijete v terminálu.
Co se tento měsíc změnilo

Programátorská koruna se přesunula na Claude Opus 5. Arena jej dohodnotila a skončil první na obou programátorských žebříčcích, WebDev se skóre 1,702.9 a image-to-WebDev se skóre 1,668.6, s Claude Fable 5 čtvrtým a druhým. To jsou hlasovací žebříčky se zveřejněnými hranicemi, takže koruna nyní spočívá na lidských srovnáních, nikoli na jediném harness, a Opus 5 to zvládá za poloviční cenu oproti Fable 5. Fable 5 se stává druhým pro nejtěžší dlouhodobé úlohy a Kimi K3 zůstává kandidátem na #2 ve WebDev. Muse Spark 1.2 od Mety dorazil 5. srpna a to nemění, protože na vlastních grafech Mety končí druhý za Opus 5 na každém zveřejněném programátorském benchmarku.

Volba kategorie, srpen 2026

Nejlepší AI na kreativitu

1
Grok 4.5
Nejméně mantinelů
2
Claude Fable 5
Próza nejvyšší kvality
3
Kimi K3
Beletrie a hlas

Nejlepší AI na nefiltrovanou, trendovou tvůrčí práci je Grok 4.5 a chceme být přesní, proč. Tato volba je o produktu, ne o kvalitě prózy. Grok 4.5 nese nejméně obsahových omezení ze všech frontier modelů a jako jediný nativní integraci X v reálném čase, což z něj dělá jediný model, který se pustí do odvážných, aktuálních nebo záměrně provokativních zadání, jež ostatní odmítají. Je výchozím modelem v aplikaci Grok pro předplatitele SuperGrok a X Premium+ za $30/měsíc. Není to nejlepší pisatel a žebříčky to říkají bez obalu. Grok 4.5 sedí na #33 na EQ-Bench Creative Writing a #41 na žebříčku tvůrčího psaní Areny a prohrává na obou se starším Grok 4.20-beta1. Pokud vybíráte podle samotné kvality výstupu, Claude Fable 5 vyhrává naprosto na #1 na Arena tvůrčí psaní a Kimi K3 vyhrává EQ-Bench. Grok 4.5 volte pro to, co vám dovolí vytvořit, ne pro to, jak dobře píše.

ModelNejlepší proSilná stránkaSlabinaCena
Grok 4.5Nefiltrovaný, vyhraněný, trendovýNejméně obsahových omezení, nativní ukotvení v X v reálném čase#33 EQ-Bench, #41 Arena tvůrčí psaní$30/měs. SuperGrok
Claude Fable 5Tvůrčí próza nejvyšší kvality#1 Arena tvůrčí psaní, #1 LiveBench LanguageOpatrné mantinely u odvážných zadání$10 / $50 API
Kimi K3Beletrie a osobitý hlas#1 EQ-Bench Creative Writing se skóre 2377Jen #10 na Arena tvůrčí psaní$3 / $15
Claude Opus 5Strukturovaná dlouhá tvůrčí práceDrží dlouhá vlákna a sám se edituje; #1 Intelligence IndexNejopatrnější ze skupiny$20/měs. Pro; $5 / $25 API
Gemini 3.1 ProMultimodální tvůrčí práceSilný řetězec textu, obrázku a videaKvóty v aplikaci GeminiZdarma / $2.00-$4.00 API vstup
Grok Imagine (Spicy Mode)NSFW / tvůrčí práce pro dospěléNejvolnější generování obrázkůNika$30/měs. SuperGrok
Druhé místo a alternativy: Claude Fable 5 je druhý a správná volba, pokud kvalita znamená víc než volnost, Kimi K3 je volba pro beletrii a Claude Opus 5 je volba pro tvůrčí projekty, které se táhnou přes mnoho kol. Pro tvůrčí práci pro dospělé je Grok Imagine Spicy Mode stále jedinou možností na úrovni frontier.
Co se tento měsíc změnilo

Grok 4.5 si drží tuto volbu a na produktu se nic nepohnulo. Je tu pro svou volnost a živý přístup k X, ne pro pozici na žebříčku, a Claude Fable 5 zůstává modelem, který použít, když chcete lepší psaní. Jedna poznámka ke jménům pro srpen: xAI nyní obchoduje na žebříčcích jako SpaceXAI a model je beze změny.

Volba kategorie, srpen 2026

Nejlepší AI na přesnost & výzkum

1
Gemini 3.1 Pro
98 % ARC-AGI-1
2
Claude Fable 5
Ukotvené vyhledávání
3
GPT-5.6 Sol
Nové uvažování

Nejlepší AI na přesnost a výzkum je Gemini 3.1 Pro. Jeho nejsilnější výsledek je na ARC-AGI-1 od ARC Prize, kde dosahuje 98 % a vyrovnává lidský panel, a to za $0.52 na úlohu. Tato kombinace je argument: několik modelů je schopnostmi blízko, žádný jej nedosahuje v ceně za spolehlivou faktografickou práci. Kombinuje to s nativním ukotvením ve vyhledávání Google, což chcete, když odpověď musí být aktuální, ne jen věrohodná. Dosahuje také 94,1 % na GPQA Diamond, kde se s ním GPT-5.6 Sol nyní vyrovnává, místo aby zaostával, a 44,4 % na Humanity's Last Exam a vede žebříček HLE od Scale SEAL se skóre 46,44. Zrušili jsme předchozí rámování přes ARC-AGI-2: jeho 77,1 % je stále správných, ale žebříček se pohnul a toto skóre jej nyní řadí kolem 14. místa. Dvě upřímné výhrady. Konkrétně u ukotveného vyhledávání vede žebříček vyhledávání Areny Anthropic, ne Google, s Gemini 3.1 Pro s ukotvením na #7. A v novém uvažování vede GPT-5.6 Sol ARC-AGI-2 a Claude Opus 5 vede ARC-AGI-3 se skóre 30 %, zhruba 3,75násobek dalšího nejlepšího modelu. Korunu jsme na Opus 5 nepřesunuli, protože Artificial Analysis měří jeho míru halucinací na 50 % a řadí jej pod Fable 5 na AA-Omniscience.

ModelNejlepší proKlíčový benchmarkSlabinaCena
Gemini 3.1 ProLevná, spolehlivá faktografická práce98 % ARC-AGI-1 (vyrovnává lidský panel) za $0.52/úlohu, 94,1 % GPQA (vyrovnáno Sol)ARC-AGI-2 77,1 % nyní ~14.; #7 na Arena vyhledávání$2.00-$4.00 / $12.00-$18.00 (odstupňováno)
Claude Fable 5Ukotvené vyhledávání#1 a #3 na žebříčku vyhledávání Areny, před GooglemŽádná jediná levná úroveň$10 / $50 (Fable 5)
GPT-5.6 SolNové uvažování#1 ARC-AGI-2 se skóre 93 %, proti 100% lidskému paneluScheming označen METR$5 / $30
Claude Opus 5Nejtěžší neviděné problémy#1 ARC-AGI-3 se skóre 30 %, ~3,75násobek dalšího modelu (ARC Prize)Artificial Analysis měří míru halucinací 50 %$5 / $25
Qwen 3.7 MaxFrontier přesnost za výhodnou cenu92,4 GPQA Diamond, 200 dotazů zdarma/denJen API, žádné chatovací rozhraní$1.25 / $3.75 promo; $2.50 / $7.50 ceníková
Claude Opus 4.6Poctivost pod tlakem#1 na žebříčku MASK od Scale SEAL se skóre 96,28; Anthropic drží top 5Nahrazen jako vlajkový modelStarší model Anthropicu
Druhé místo a alternativy: modely Anthropicu jsou druhé pro ukotvené vyhledávání a zametají žebříček poctivosti pod tlakem, GPT-5.6 Sol je druhý pro nové uvažování a Qwen 3.7 Max je výhodná volba na frontier.
Co se tento měsíc změnilo

Gemini 3.1 Pro si drží korunu za přesnost, ale jeho hlavní číslo už není náskokem. Jeho skóre GPQA Diamond se přepočítalo na 94,1 % a GPT-5.6 Sol se s ním nyní přesně vyrovnává, takže koruna spočívá na výsledku ARC-AGI-1 za $0.52 na úlohu plus ukotvení ve vyhledávání, nikoli na GPQA. Toto je další koruna, kterou znovu testujeme: Claude Fable 5 vede všechny tři žebříčky, které měří, jak často se model prostě mýlí, se skóre 40 na AA-Omniscience, 61 % na Omniscience Accuracy a 53,3 % na Humanity's Last Exam.

Volba kategorie, srpen 2026

Nejlepší AI na řešení problémů

1
GPT-5.6 Sol
Vlajkový model pro STEM
2
Claude Opus 5
Agentické řetězce
3
GPT-5.5 Pro
Ověřený FrontierMath

Nejlepší AI na těžké řešení problémů je GPT-5.6 Sol a je to nejlépe podložená koruna na této stránce. Bere #1 na LiveBench Mathematics se skóre 96,2, #1 na LiveBench Reasoning se skóre 91,7 a #1 na ARC-AGI-2 se skóre 93 %, nejblíže, jak kdy nějaký model dospěl ke 100% lidskému panelu. Tři samostatné firmy jej řadí první v úlohách uvažování, na kterých záleží, což je víc shody, než produkuje jakákoli jiná kategorie na této stránce. OpenAI stále nezveřejnil skóre Sol na FrontierMath, takže ověřenou známkou OpenAI zůstává 39,6 % u GPT-5.5 Pro na FrontierMath Tier 4 a Solovo číslo doplníme ve chvíli, kdy vyjde na veřejnost. Qwen 3.7 Max je výhodná alternativa pro problémy soutěžního typu se skóre 97,1 na indexu HMMT z února 2026 a 44,5 na Apex, za zlomek ceny ChatGPT Pro, a nyní zahrnuje 200 dotazů na model zdarma denně. Claude Opus 5 je alternativa pro dlouhé agentické řetězce uvažování, vede Agentic Index od Artificial Analysis se skóre 55,3 a ARC-AGI-3 od ARC Prize se skóre 30 %, zhruba 3,75násobek dalšího nejlepšího modelu.

ModelNejlepší proKlíčový benchmarkSlabinaCena
GPT-5.6 SolNejtěžší matematika, věda a uvažování#1 LiveBench Mathematics (96.2), #1 LiveBench Reasoning (91.7), #1 ARC-AGI-2 (93 %)FrontierMath stále nezveřejněn; scheming označen METR$100/měs. ChatGPT Pro; API $5 / $30
Claude Opus 5Dlouhé agentické řetězce uvažování#1 Agentic Index (55.3), #1 ARC-AGI-3 (30 %)Druhý na LiveBench Reasoning; míra halucinací 50 %$5 / $25
GPT-5.5 ProOvěřený lídr FrontierMath39,6 % FrontierMath Tier 4Nahrazen Sol jako vlajkový model$100/měs. ChatGPT Pro
Qwen 3.7 MaxSoutěžní matematika na rozpočet97,1 HMMT 2026 únor, 44,5 Apex, 200 dotazů zdarma/denJen API$1.25 / $3.75 promo; $2.50 / $7.50 ceníková
Claude Fable 5Matematika uvnitř programátorského workflow#1 na matematické podkategorii Areny (1543), 96,0 LiveBench MathematicsNejdražší volba zde$10 / $50
GLM-5.2Open-weight řešení problémůNejvyšší otevřený Intelligence Index se skóre 51, MIT, 1M kontextJen self-host nebo poskytovatelOpen weights (MIT)
Druhé místo a alternativy: Claude Opus 5 je druhý a přirozená volba pro dlouhé řetězce agentického uvažování, Claude Fable 5 je druhý na matematickém žebříčku Areny, Qwen 3.7 Max je výhodná volba a GLM-5.2 je open-weight volba.
Co se tento měsíc změnilo

GPT-5.6 Sol si drží tuto korunu a získal druhý argument. Sol nyní také vede Terminal-Bench v2.1 od Artificial Analysis se skóre 89,5 % a jeho Coding Index se skóre 78,3 a vyrovnává se Gemini 3.1 Pro na GPQA Diamond se skóre 94,1 %. Claude Opus 5 zůstává alternativou pro agentické uvažování na síle ARC-AGI-3. Dne 1. srpna OpenAI pojmenoval svou další rodinu modelů Astra a zveřejnil deset nových matematických výsledků z interní verze, ačkoli Astra je nevydaná a nemá datum, cenu ani dostupnost.

Volba kategorie, srpen 2026

Nejlepší AI agent

1
Gemini Spark
24/7 cloud
2
Claude Cowork
Desktopová AI
3
ChatGPT Codex
Programátorský agent

Nejlepším AI agentem právě teď je Gemini Spark pro práci běžící v cloudu 24/7 a Claude Cowork pro práci běžící na desktopu, s ChatGPT Codex jako alternativou pro programátorské agenty a s prohlížečovými agenty třídy OpenAI Operator jako alternativou pro webové úlohy. AI agenti jsou nejrychleji se pohybující kategorií roku 2026: každý top dodavatel nyní dodává agentní produkt a praktická volba je mezi agenty, kteří žijí v cloudu (běží, když je váš laptop zavřený), a agenty, kteří žijí na vašem desktopu (řídí vaše aplikace přímo). Gemini Spark byl uveden na Google I/O dne 19. května 2026 a je prvním cloudovým agentem 24/7. Claude Cowork dosáhl obecné dostupnosti 9. dubna 2026 a běží jako desktopový agent, který řídí vaše lokální aplikace. ChatGPT Codex Mobile (14. května) je volba pro práci s programátorskými agenty. Přečtěte si úplné srovnání Gemini Spark vs. Claude Cowork.

AgentNejlepší proKde běžíSilná stránkaCena
Gemini Spark24/7 cloudové úlohy, workflow WorkspaceGoogle Cloud VM (vždy zapnuto)První skutečný agent 24/7, hluboká integrace Workspace$99.99/měs. Google AI Ultra
Claude CoworkDesktop, řízení aplikací, design + kódVáš desktop Mac/WindowsŘídí lokální aplikace, vidí vaši obrazovku$20/měs. Claude Pro
ChatGPT Codex MobileProgramátorský agent v telefonuCloud OpenAI + iOS/AndroidSchvalování diffů a přesměrování práce z telefonuZahrnuto v plánech ChatGPT
Grok Agentic (Grok 4.5)Výzkum v reálném čase, scraping XCloud xAINativní integrace X$30/měs. SuperGrok
OpenAI třídy OperatorÚlohy v prohlížeči, webové formulářeCloud OpenAI + váš prohlížečWebová automatizaceChatGPT Pro
Druhé místo a alternativy: Claude Cowork je druhý celkově a přirozená volba, když chcete agenta na svém stroji, který řídí vaše aplikace. ChatGPT Codex Mobile je druhý pro programátorské agenty. Grok Agentic je nika pro výzkum v reálném čase.
Co se tento měsíc změnilo

Žádní noví spotřebitelští agenti nevyšli a Muse Code od Mety (5. srpna) je terminálový vývojářský nástroj, nikoli spotřebitelský, takže volba mezi Gemini Spark (cloud) a Claude Cowork (desktop) stále řídí většinu rozhodnutí o agentech pro jednotlivé uživatele. Modelová vrstva pod nimi se opět pohnula: Claude Opus 5 (24. července) vzal #1 na Agentic Index od Artificial Analysis se skóre 55,3, před GPT-5.6 Sol se skóre 54,0 a Claude Fable 5 se skóre 52,8, a stojí $5 / $25. Opus 5 také vede žebříček Agent Areny, s Kimi K3 na třetím místě. Pro týmy stavějící vlastní agenty je Muse Spark 1.2 od Mety (5. srpna) levná agentně nativní možnost za $1.25 / $4.25, jejíž GDPval-AA v2 agentické Elo skočilo z 1371 na 1631, ačkoli Scale SEAL ohodnotil jen starší 1.1, která vede jeho žebříček používání nástrojů MCP Atlas se skóre 88,1. GLM-5.2 (MIT) je nejsilnější open-weight agentní model, který si můžete hostit na skromném hardwaru, na #5 na žebříčku Agent Areny.

Průvodce použitím, srpen 2026

Nejlepší AI pro studenty

1
GPT-5.5 Free
Eseje & výzkum
2
Gemini 3.6 Flash
STEM + PDF
3
Claude Sonnet 5
Psaní & úpravy

Nejlepší AI pro studenty je GPT-5.5 Free uvnitř ChatGPT pro obecnou práci na kurzech a Gemini 3.6 Flash Free uvnitř aplikace Gemini pro STEM a multimodální studium, s Qwen 3.7 Max jako API alternativou pro těžší sady úloh (200 dotazů zdarma denně) a Claude Opus 5 jako alternativou pro úpravy esejí. Většina studentů nemusí platit: bezplatná úroveň ChatGPT nyní ve výchozím nastavení používá GPT-5.6 (s GPT-5.5 stále dostupným), Gemini 3.6 Flash je v bezplatné aplikaci Gemini a v AI Studio, Claude Sonnet 5 je nový bezplatný výchozí Claude a DeepSeek V4 je zdarma na chatovací stránce DeepSeeku. Pro krok za krokem u nejtěžší matematiky je GPT-5.6 Sol novým vlajkovým modelem OpenAI (jeho skóre FrontierMath ještě není zveřejněno, přičemž ověřených 39,6 % u GPT-5.5 Pro na FrontierMath Tier 4 je současnou známkou), ačkoli oba jsou jen placené; Qwen 3.7 Max je výhodná alternativa se skóre 97,1 HMMT 2026 únor s cenami API $1.25 / $3.75 na jeho aktuální 50% promo ($2.50 / $7.50 ceníková).

ÚlohaNejlepší modelPročZdarma?Alternativa
Eseje & práce na kurzechGPT-5.5Zdarma v ChatGPT, zlepšená faktografická spolehlivost vs. 5.4AnoClaude Sonnet 5 (Claude zdarma)
Řešení STEM úlohGPT-5.6 Sol / Qwen 3.7 MaxNový vlajkový model pro STEM (5.5 Pro: 39,6 % FrontierMath) / 97,1 HMMT 2026 únorPro placené / Qwen API placenéGemini 3.6 Flash (zdarma)
Výzkum & přesnostGemini 3.1 Pro98 % ARC-AGI-1 za $0.52/úlohu, nativní ukotvení ve vyhledávání GoogleAno (aplikace Gemini)Claude Opus 5
Úpravy textuClaude Sonnet 5Zdarma a výchozí na claude.ai; Claude Fable 5 je lídr kvalityAno (Claude zdarma)Claude Fable 5
Multimodální studium (PDF, snímky, obrázky)Gemini 3.6 Flash1M kontext, zdarma v aplikaci GeminiAnoNotebookLM (Google)
Druhé místo a alternativy: Claude Sonnet 5 (zdarma) je druhý pro psaní a úpravy esejí. Gemini 3.6 Flash (zdarma) je druhý pro multimodální studium a příjem PDF. DeepSeek V4 je druhý pro řešení problémů na přísně nulovém rozpočtu.
Průvodce použitím, srpen 2026

Nejlepší AI pro práci & profesionály

1
GPT-5.6
Každodenní znalostní práce
2
Claude Opus 5
Programování & psaní
3
Gemini 3.1 Pro
Výzkum & podklady

Nejlepší AI pro profesionální práci je GPT-5.6 (výchozí model ChatGPT od 9. července) pro každodenní znalostní práci, Claude Opus 5 pro programování a psaní s vysokou mírou odpovědnosti a Gemini Spark pro agentické workflow 24/7. Většina profesionálů vytěží nejvíc, když provozuje dvě placená předplatná (ChatGPT Plus za $20/měsíc plus Claude Pro za $20/měsíc, celkem $40/měsíc), nebo konsoliduje s Fello AI za $9.99/měsíc pro všech pět top modelů v jedné aplikaci pro Mac/iOS. Pro agentickou práci, která běží, když spíte, je Gemini Spark na Google AI Ultra za $99.99/měsíc jediným skutečným cloudovým agentem 24/7.

Případ použitíNejlepší modelKlíčový údajCenaAlternativa
Každodenní znalostní práceGPT-5.6Výchozí model ChatGPT od 9. července; asistent, kterého většina otevře$20/měs. ChatGPT PlusClaude Opus 5
Programování (proprietární)Claude Opus 5#1 na Arena WebDev (1,702.9) a image-to-WebDev (1,668.6); doporučený výchozí model Anthropicu$20/měs. Claude ProClaude Fable 5
Programování (nákladově efektivní)Qwen 3.7 Max80,4 SWE-Verified, 1M kontext$1.25 / $3.75 promo; $2.50 / $7.50 ceníkováDeepSeek V4-Flash 0731
Výzkum & podkladyGemini 3.1 Pro98 % ARC-AGI-1 za $0.52/úlohu, ukotvení GoogleGoogle AI Pro / UltraClaude Opus 5
Těžká matematika, fyzika, finanční modelováníGPT-5.6 SolNový vlajkový model OpenAI pro STEM (5.5 Pro ověřeno na 39,6 % FrontierMath)$100/měs. ChatGPT ProQwen 3.7 Max
Nepřetržité agentické workflowGemini SparkPrvní cloudový agent 24/7$99.99/měs. Google AI UltraClaude Cowork
Živé zprávy, tvůrčí práce s kontextem XGrok 4.5Třída Opus + nativní ukotvení v X$30/měs. SuperGrokGemini 3.1 Pro
Konsolidace vše v jednomFello AIChatGPT + Claude + Gemini + Grok + DeepSeek$9.99/měs.Platit každému dodavateli zvlášť
Druhé místo a alternativy: pro většinu profesionálních týmů je Claude Opus 5 druhý za GPT-5.6 pro každodenní práci a nyní programátorský lídr naprosto za $5 / $25, s Claude Fable 5 druhým pro nejtěžší dlouhodobé úlohy. Gemini 3.1 Pro je druhý pro role náročné na výzkum a Gemini Spark je jedinečná volba, pokud dokážete nasadit cloudového agenta na dlouhé úlohy.
Srovnání cen

Ceny AI modelů v srpnu 2026

Od bezplatných verzí za $0 po $199.99/měsíc Google AI Ultra. Nejzávažnější cenou v této tabulce je Claude Opus 5 za $5 / $25, protože je to #1 model na Intelligence Index od Artificial Analysis za poloviční cenu oproti Claude Fable 5. Muse Spark 1.2 od Mety je uveden za $1.25 / $4.25, s úrovní Contributor za $0.10 / $0.20 pro každého, kdo je ochoten nechat Metu trénovat na svých promptech, a Grok 4.5 je uveden za $2 / $6. Volbou s nejlepším poměrem cena/výkon je nyní DeepSeek V4-Flash 0731 za $0.14 / $0.28, který se vyrovná Intelligence Indexu 50 u Gemini 3.6 Flash a stojí $0.03 na indexovou úlohu proti $0.56 u Flash. Mezi uzavřenými modely je GPT-5.6 Luna nejlevnější za $0.20 / $1.20 po snížení OpenAI z 30. července. Podrobnější rozbor najdete v našem úplném průvodci srovnáním cen AI.

ModelVstup (za 1M)Výstup (za 1M)KontextPřístup zdarma?
GPT-5.5$5.00$30.001M (400K v Codex)ChatGPT Free; API placené
GPT-5.5 Pro$30.00$180.001MChatGPT Pro od $100/měs. (úroveň s vyšším použitím $200)
GPT-5.6 Sol$5.00$30.00NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
GPT-5.6 Terra$2.00$12.00NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
GPT-5.6 Luna$0.20$1.20NezveřejněnoŽivé v ChatGPT, Codex & API (9. července)
Claude Opus 5$5.00$25.001MVýchozí v Claude Pro/Max; API placené
Claude Opus 4.8$5.00$25.001MStarší model u Anthropicu; Pro/Max/API
Claude Fable 5$10.00$50.001MTrvale v Max/Team Premium (~50 % limitů použití); Pro/Team Standard přes kredity
Claude Sonnet 5$2.00 úvodní / $3.00 ceníková$10.00 úvodní / $15.00 ceníková1MVýchozí v Claude Free & Pro; API placené
Claude Sonnet 4.6$3.00$15.001MAPI placené (nahrazeno Sonnet 5)
Gemini 3.1 Pro$2.00 (≤200K) / $4.00 (>200K)$12.00 (≤200K) / $18.00 (>200K)1MOmezená aplikace Gemini; API placené
Gemini 3.6 Flash$1.50$7.501MAplikace Gemini/AI Studio; bezplatná úroveň API + placené API
Gemini 3.5 Flash-Lite$0.30$2.501MAI Studio; bezplatná úroveň API + placené API
Qwen 3.7 Max$1.25 promo / $2.50 ceníková$3.75 promo / $7.50 ceníková1M200 dotazů zdarma/den; API placené nad rámec
MiniMax M3$0.30 (50 % z $0.60)$1.20 (≤512K)1MOpen weights; náklady na hosting
LongCat-2.0Závisí na poskytovateliZávisí na poskytovateli1MOpen weights (MIT); náklady na hosting
NVIDIA Nemotron 3 UltraZávisí na poskytovateliZávisí na poskytovateli1MOpen weights (OpenMDW); náklady na hosting
Qwen 3.5 (open-weight)Self-host / TogetherSelf-host / Together1MOpen weights; náklady na hosting
Nex-N2-ProSelf-host / poskytovateléSelf-host / poskytovatelé1MOpen weights (Apache 2.0); náklady na hosting
Rio 3.5 Open 397BSelf-host / poskytovateléSelf-host / poskytovatelé1MOpen weights (MIT); náklady na hosting
Grok 4.3$1.25$2.501MBezplatný spotřebitelský plán; API placené
Grok 4.5$2.00$6.00500KGrok Build / Cursor / konzole xAI; EU částečně, konzole API stále zavřená
Muse Spark 1.2$1.25 ($0.10 úroveň Contributor)$4.25 ($0.20 úroveň Contributor)1MPlacené API; Muse Code, Meta Model API a OpenRouter; úroveň Contributor mění práva k trénování za ~92% slevu
Kimi K3$3.00 ($0.30 cache-hit)$15.001MBezplatná základní úroveň v aplikaci Kimi; open weights na Hugging Face (Kimi K3 License)
Gemini Omni Flash (video)$1.50$17.50 (video výstup)10sekundové klipyAplikace Gemini / Flow; AI Studio + API
DeepSeek V4-Pro$0.435 ($0.0036 cache-hit)$0.871MDeepSeek Chat zdarma; API placené
DeepSeek V4-Flash 0731$0.14$0.281MDeepSeek Chat zdarma; API placené
Kimi K2.7 CodeZávisí na poskytovateliZávisí na poskytovateli256KOpen weights; náklady na hosting
GLM-5.2Závisí na poskytovateliZávisí na poskytovateli1MOpen weights; náklady na hosting
ERNIE 5.1Ceny pro region ČínaCeny pro region Čína256KBezplatná úroveň Baidu
Gemini Spark (agent)Bez ceny APIBez ceny API1M (základ Gemini)Google AI Ultra $99.99 nebo $199.99/měs.
Fello AI (agregátor)Směrováno přes aplikaciSměrováno přes aplikaciZávisí na modelu$9.99/měs., bezplatná verze dostupná

Výše uvedené sazby pro GPT-5.5 a GPT-5.5 Pro jsou ceny pro krátký kontext; OpenAI již specifické údaje pro dlouhý kontext nezveřejňuje. Úrovně GPT-5.6 se účtují za 2násobek vstupu a 1,5násobek výstupu, jakmile prompt přesáhne 272K vstupních tokenů, což dává long-context Terra na $4 / $18 a Luna na $0.40 / $1.80. Pokud chcete přístup k více AI modelům bez správy samostatných předplatných, Fello AI poskytuje GPT, Claude, Gemini, Grok, Perplexity a další v jediné aplikaci pro Mac, iPhone a iPad od $9.99/měsíc.

Open-weight modely

Nejlepší open-weight modely v srpnu 2026

Nejlepším open-weight modelem v srpnu 2026 je Kimi K3 a převzal vedení ve chvíli, kdy Moonshot 27. července 2026 zveřejnil váhy. Drží nejvyšší Intelligence Index ze všech open-weight modelů se skóre 57 na Artificial Analysis v4.1, šest bodů před GLM-5.2, a na Areně je stále nejvýše umístěným otevřeným záznamem, na #2 ve WebDev (1,675.5) hned za Claude Opus 5 a #3 na žebříčku Agent. O tom, který z nich byste měli skutečně použít, rozhoduje jeden háček. Stažení K3 je 96 shardů safetensors a zhruba 1,56 TB, což potřebuje vícenodový GPU cluster místo pracovní stanice, a vychází pod vlastní licencí Kimi K3 License místo MIT. Takže GLM-5.2 (Z.ai, MIT) zůstává naším praktickým doporučením pro týmy provozující vlastní váhy, na Intelligence Index 51, #6 na Arena WebDev (1,587.1) a #5 na žebříčku Agent. Třetí místo změnilo majitele poslední červencový den: DeepSeek V4-Flash 0731 byl dotrénován a skočil z Intelligence Index 40 na 50, za $0.14 / $0.28 pod MIT.

ModelNejlepší proKlíčový benchmarkKontext / LicenceKde spustit
Kimi K3Nejlépe hodnocený open-weight model, agentická a webová práceII 57 (v4.1), nejvyšší ze všech open-weight modelů; #2 Arena WebDev, #3 Arena Agent; 2.8T/104B aktivních1M / Kimi K3 LicenseHugging Face (96 shardů, 1.56 TB), Moonshot API, poskytovatelé
GLM-5.2Dlouhodobé agentické programování, 1M kontextII 51 (v4.1), nejvyšší, který si můžete hostit na skromném hardwaru; 744B/40B aktivních1M / MITZ.ai, Hugging Face, OpenRouter
DeepSeek V4-Flash 0731Nejlepší poměr cena/výkon ze všech modelů na stránceII 50 (v4.1), z 40 dne 31. července; $0.03 na indexovou úlohu, 284B/13B aktivních1M / MITDeepSeek API ($0.14/$0.28), lokálně
LongCat-2.0Frontier otevřený kodér trénovaný na čínských čipechII 33 (v4.1); 59,5 % SWE-Bench Pro (dodavatel), 1.6T/~48B aktivních1M / MITHugging Face, GitHub, OpenRouter
MiniMax M3Levný multimodální model třídy frontierII 44 (v4.1), 59 % SWE-Bench Pro, multimodální1M / licence TBDHugging Face, API $0.30/1M (50 % sleva)
Nex-N2-ProNejsilnější otevřené programátorské skóreII 41 (v4.1); 80,8 SWE-Bench Verified, 397B/17B aktivníchZaloženo na Qwen / Apache 2.0Hugging Face, poskytovatelé, self-host
Kimi K2.7 CodeNejsilnější komerčně licencovaný otevřený kodér+21,8 % na Kimi Code Bench v2 vs. K2.6 (dodavatel); 1T/32B aktivních256K / Modified MITHugging Face, DeepInfra, poskytovatelé
DeepSeek V4-ProAgentická práce v reálném světěII 44 (v4.1), 1.6T/49B aktivních1M / MITDeepSeek API ($0.435/$0.87), lokálně
Hy3Nejnovější účastník s permisivní licencíII 41 (v4.1); #22 na Arena WebDev (1,516.4)Apache 2.0Hugging Face, poskytovatelé, self-host
InklingPrvní open-weight model Thinking MachinesII 41 (v4.1), agentický 32,3, vydán 15. červenceOpen weightsHugging Face, poskytovatelé, self-host
Inkling SmallStejná rodina při čtvrtině velikostiII 40 (v4.1), agentický 30,8; 276B/12B aktivních, vstup text, obrázek a zvukApache 2.0Hugging Face (BF16 a NVFP4), poskytovatelé, self-host
NVIDIA Nemotron 3 UltraLaděno NVIDIA, plně permisivní licenceII 38 (v4.1), 65-70,4 SWE-Bench Verified, 550B/55B aktivních1M / OpenMDWOpenRouter, Hugging Face, AWS (8x B200 self-host)
Qwen 3.5 (397B / 17B aktivních)Multimodální, rychlé dekódování88,4 GPQA, 91,3 AIME 2026, 83,6 LiveCodeBench v61M / otevřenéTogether, OpenRouter, lokálně
Qwen3.6-35B-A3BEfektivní otevřený agentický kodér (3B aktivních)86,0 GPQA Diamond, 92,7 AIME 2026, 35B/3B aktivních262K (do 1M YaRN) / Apache 2.0Hugging Face, OpenRouter, lokálně
Qwen3.6-27BHustý kodér spustitelný na laptopu87,8 GPQA Diamond, hustý 27B, multimodální256K / Apache 2.0Lokálně Mac/PC, Hugging Face, OpenRouter
Rio 3.5 Open 397BFine-tune Qwen 3.5, vícejazyčné uvažování70,8 Terminal-Bench 2.1 (first-party), poráží Qwen 3.7 Plus na 4/5397B/17B aktivních / MITHugging Face, poskytovatelé, self-host
Llama 4 MaverickVlajkový model řady Meta17B aktivních / 400B celkových parametrůLlama 4 licenseCloud Meta, Hugging Face, lokálně
NVIDIA Nemotron 3 Nano OmniEdge / nízký výkonMultimodální, velmi malá stopaKompaktní / otevřenéLokálně, nástroj NVIDIA

Licencování zde záleží stejně jako holé skóre: Kimi K2.7 (Modified MIT), DeepSeek V4 (MIT), GLM-5.2 (MIT), LongCat-2.0 (MIT), Hy3 (Apache 2.0), Nex-N2-Pro (Apache 2.0) a Nemotron 3 Ultra (OpenMDW) všechny jasně umožňují komerční použití, zatímco MiniMax M3 vychází pod vlastní komunitní licencí a Kimi K3 sedí na vlastní custom licenci s prahem tržeb pro každého, kdo jej přeprodává jako službu. Žádný open-weight model už není první na žádném žebříčku Areny, který sledujeme: Claude Opus 5 vzal žebříček Agent v červenci, poslední, který open-weight model vedl.

Jak hodnotíme

Benchmarky, ceny a praktické používání

Každé hodnocení na této stránce kombinuje tři vstupy: veřejné benchmarky od sedmi nezávislých firem (Artificial Analysis, Arena dříve LMArena, Scale SEAL, LiveBench, EQ-Bench, ARC Prize a oficiální žebříček Terminal-Bench 2.1, pokrývající indexy Intelligence a Agentic, GPQA Diamond, ARC-AGI-1 až 3, Humanity's Last Exam, GDPval-AA, FrontierMath, HMMT, MCP Atlas, SWE Atlas a Remote Labor Index), zveřejněné ceny API a předplatného z oficiální cenové stránky každého dodavatele a praktické používání redakčním týmem FelloAI, který spouští reálné prompty na téže úloze na každém modelu. Oficiální zdroje cen a benchmarků znovu načítáme před každou měsíční aktualizací.

Benchmarky jsou váženy podle případu použití: SWE-bench a Terminal-Bench pohánějí programování, GPQA Diamond a ARC-AGI-2 pohánějí přesnost, GDPval-AA (benchmark profesionálních výstupů od Artificial Analysis) informuje kvalitu profesionálních úloh, zatímco styl psaní se posuzuje primárně praktickým testováním, FrontierMath a HMMT pohánějí řešení problémů. Zveřejňujeme, když je benchmark hlášen dodavatelem, ale nezávisle neověřen, a vyřazujeme každé tvrzení, které nedokážeme reprodukovat proti živému zdroji. Nehýbeme korunou kategorie na síle jediného žebříčku, a když je nový model příliš čerstvý na to, aby jej žebříčky lidských preferencí ohodnotily, řekneme to, místo abychom jej korunovali jen na skóre benchmarků. Když model mezi aktualizacemi projde velkým upgradem, kategorii přehodnotíme a přidáme řádek „Co se tento měsíc změnilo" na konec podrobné analýzy.

Často kladené dotazy

Časté dotazy

Jaký je nejlepší AI model právě teď v srpnu 2026?
Záleží na úloze. V celkovém skóre benchmarků je Claude Opus 5 (24. července) #1 na Intelligence Index od Artificial Analysis se skóre 61 a jeho Agentic Index se skóre 55,3 a Arena jej nyní ohodnotila na vrcholu čtyř svých žebříčků, včetně obou programátorských. Pro každodenní chat je GPT-5.6 výchozím modelem ChatGPT od 9. července a asistentem, kterého většina lidí skutečně otevře, ačkoli Claude Fable 5 vede textový žebříček Areny. Pro programování je Claude Opus 5 #1 na žebříčcích WebDev (1,702.9) a image-to-WebDev (1,668.6) Areny za poloviční cenu oproti Fable 5. Pro psaní je Claude Fable 5 #1 na textovém žebříčku Areny (1508.6), Humanity's Last Exam (53,3 %) a AA-Omniscience (40). Pro přesnost vyrovnává Gemini 3.1 Pro lidský panel na ARC-AGI-1 se skóre 98 % za $0.52 na úlohu. Pro těžkou matematiku a uvažování je GPT-5.6 Sol #1 na LiveBench Mathematics, LiveBench Reasoning a ARC-AGI-2. Pro obrázky vede ChatGPT Images 2.0 oba žebříčky a pro video vede Gemini Omni Flash oba. Pro agenty je Gemini Spark cloudový agent 24/7 a Claude Cowork desktopový.
Co je Claude Opus 5?
Claude Opus 5 je nejnovější vlajkový model Anthropicu, vydaný 24. července 2026, a současný #1 model na Artificial Analysis. Vede jak Intelligence Index se skóre 61, tak Agentic Index se skóre 55,3 a kraluje žebříčku GDPval-AA v2 pro profesionální výstupy se skóre 1858, výrazně před 1746 od Claude Fable 5. Ceny API jsou $5 / $25 za 1M tokenů, stejné jako Opus 4.8 a poloviční oproti Fable 5, s kontextovým oknem 1M tokenů a znalostním cutoff z května 2026. ARC Prize nezávisle potvrzuje uváděcí tvrzení Anthropicu k ARC-AGI-3, kde Opus 5 dosahuje 30 % proti 8 % u dalšího nejlepšího modelu, zhruba 3,75násobek. Arena jej od té doby ohodnotila a řadí jej na #1 ve WebDev, image-to-WebDev, Document a na žebříčku Agent a na #6 v textu, a to je to, co mu přisoudilo programátorskou korunu. Jedna věc, kterou mít na paměti: Artificial Analysis měří jeho míru halucinací na 50 %, což je důvod, proč na této stránce nedrží žádnou korunu za přesnost.
Je Claude Fable 5 zpět?
Ano. Anthropic znovu nasadil Claude Fable 5 dne 1. července 2026 poté, co vláda USA zrušila exportní omezení, které uvalila 12. června. Je opět dostupný na Claude API, Claude.ai, Claude Code a Claude Cowork. Anthropic učinil Fable 5 v placených plánech trvalým 20. července 2026. Max a Team Premium jej zahrnují zhruba na 50 % běžných limitů použití; Pro a Team Standard k němu dosáhnou přes kredity použití s jednorázovým startovním kreditem $100. Ceny API jsou $10 / $50 za milion tokenů. Fable 5 je model třídy Mythos postavený pro dlouhodobou agentickou práci s kontextem 1M tokenů a je druhý pro programování za Claude Opus 5, na #2 na žebříčku image-to-WebDev Areny (1,625.7) a #4 ve WebDev.
Co je GPT-5.6 a mohu jej používat?
Ano, od 9. července 2026. GPT-5.6 je rodina modelů OpenAI nové generace a po dvoutýdenním uzavřeném náhledu, který začal 26. června za bezpečnostní prověrkou vlády USA, dosáhla obecné dostupnosti 9. července. Existují tři úrovně, od nejméně po nejschopnější: Luna, rychlá, nejlevnější úroveň ($0.20 / $1.20 za 1M tokenů); Terra, vyvážený každodenní model, o němž OpenAI říká, že se vyrovná GPT-5.5 ($2 / $12); a Sol, vlajkový model laděný pro biologii, chemii a kyberbezpečnost ($5 / $30). OpenAI snížil Lunu o 80 % a Terru o 20 % dne 30. července 2026 a nechal Sol a každou cenu předplatného ChatGPT nedotčenou. Nyní je živý napříč ChatGPT, Codex a API jako výchozí model OpenAI. Jedna výhrada: system card OpenAI a externí hodnotitel METR upozornili na zvýšené chování „scheming" u Sol, takže s ním u faktografické práce s vysokou odpovědností zacházejte opatrně, dokud se nezávislé výsledky neustálí.
Je už Grok 4.5 venku?
Ano. xAI vydala Grok 4.5 veřejně dne 8. července 2026, svůj první vlajkový model od chvíle, kdy SpaceX pohltila společnost a vstoupila na burzu jako SPCX. Elon Musk jej popisuje jako „model třídy Opus, ale rychlejší, tokenově efektivnější a levnější". Je trénovaný na Cursor a zaměřený na programování a agentickou práci, s cenou $2 / $6 za 1M tokenů a kontextovým oknem 500K tokenů. Je živý v Grok Build, Cursor na všech plánech a konzoli xAI. Přístup pro EU se začal zavádět po oznámení z 16. července a je stále částečný, přičemž Cursor hlásí dostupnost, zatímco konzole API od xAI zůstává pro uživatele z EU zavřená. Artificial Analysis jej hodnotí na Intelligence Index 54 na v4.1, vyrovnaný s polem na Terminal-Bench 2.1 (83,3 %), ale zaostávající na SWE-Bench Pro se skóre 64,7 %, takže je to výhodná volba, nikoli jednoznačný lídr benchmarků. Grok 4.5 je také naší volbou pro kreativitu, z produktových důvodů, ne kvůli kvalitě, protože sedí na #33 na EQ-Bench Creative Writing; pro nejlépe napsaný výstup vyhrává Claude Fable 5 naprosto.
Která AI je nejlepší na programování?
Claude Opus 5 je nejlepší na programování a vyhrává dva žebříčky, kde vývojáři hlasují o výsledku, spíše než harness spouští skript: #1 na žebříčku WebDev Areny (1,702.9) a #1 v image-to-WebDev (1,668.6), k hlasovacím hranicím 1. srpna a 31. července. Běží $5 / $25 za 1M tokenů, poloviční oproti Claude Fable 5, a vlastní dokumentace Anthropicu radí začít s Opus 5 pro komplexní agentické programování. Claude Fable 5 je druhý pro nejtěžší dlouhodobé úlohy na #2 image-to-WebDev a #4 WebDev a Kimi K3 je kandidátem na #2 ve WebDev (1,675.5). Vezměte na vědomí, že Coding Index od Artificial Analysis není zametení Claudem: GPT-5.6 Sol (xhigh) jej vede se skóre 78,3 s Opus 5 na 78,0, dost blízko na remízu. DeepSeek V4-Flash 0731 je volba s nejlepším poměrem cena/výkon za $0.14 / $0.28 a GLM-5.2 (MIT) je nejlepší open-weight kodér, který si můžete hostit sami.
Která AI je nejlepší na psaní?
Claude Fable 5 je nejlepší na psaní a je to jediný model v první trojce všech tří nezávislých žebříčků pro psaní: #1 na Arena tvůrčí psaní, #1 na LiveBench Language (90.7) a #3 na EQ-Bench Creative Writing v3. Stojí $10 / $50 za 1M tokenů. Claude Sonnet 5 je volba s nejlepším poměrem cena/výkon a to, co by většina lidí měla skutečně použít, protože je zdarma a výchozí na claude.ai za úvodní cenu $2 / $10, ačkoli se řadí na #53 na Arena tvůrčí psaní. Kimi K3 vyhrává EQ-Bench naprosto se skóre 2377, pokud chcete osobitou beletrii, Claude Opus 5 kraluje žebříčku GDPval-AA v2 pro profesionální výstupy se skóre 1858, GPT-5.5 je alternativa pro faktograficky ukotvené obchodní psaní a Gemini 3.6 Flash je volba s nejlepším poměrem cena/výkon pro hromadný obsah.
Jaký je nejlepší open-weight AI model v roce 2026?
Kimi K3 je právě teď nejlepší open-weight model a je jím od chvíle, kdy Moonshot 27. července 2026 zveřejnil váhy. Má nejvyšší Intelligence Index ze všech open-weight modelů se skóre 57 na Artificial Analysis v4.1 a na Areně je #2 ve WebDev a #3 na žebříčku Agent. Háček je v tom, že je to 96 shardů a zhruba 1,56 TB pod vlastní licencí Kimi K3 License, takže GLM-5.2 (13. června, MIT) zůstává modelem, který si většina týmů skutečně dokáže hostit, na Intelligence Index 51 a #6 na Arena WebDev. Třetí je DeepSeek V4-Flash 0731, který 31. července skočil z Intelligence Index 40 na 50 beze změny ceny, velikosti nebo licence, čímž se stal nejlepším poměrem cena/výkon v otevřeném poli za $0.14 / $0.28 pod MIT. Upřímně stojí za to vědět, že žádný open-weight model už není první na žádném žebříčku Areny, který sledujeme.
Jaký je nejlevnější AI model třídy frontier?
V cenách API za milion tokenů je GPT-5.6 Luna nyní nejlevnějším uzavřeným modelem třídy frontier za $0.20 / $1.20 poté, co jej OpenAI 30. července 2026 snížil o 80 %, a Artificial Analysis jej hodnotí na Intelligence Index 51, o bod výše než Gemini 3.6 Flash. Ještě levnější je DeepSeek V4-Flash 0731 za $0.14 / $0.28, který je nyní naší volbou s nejlepším poměrem cena/výkon: vyrovná se Intelligence Indexu 50 u Gemini 3.6 Flash a stojí $0.03 na indexovou úlohu proti $0.56 u Flash, pod licencí MIT, kterou si můžete hostit sami. MiniMax M3 je nyní uveden za $0.30 za milion vstupních tokenů na trvalé 50% slevě, s LongCat-2.0 jako silnou alternativou pod MIT. Qwen 3.7 Max za $1.25 / $3.75 na jeho aktuální promo je výhodná volba na Intelligence Index 46, ačkoli Luna jej nyní podbízí jak cenou, tak skóre.
Které AI modely jsou zdarma?
ChatGPT Free nyní ve výchozím nastavení používá GPT-5.6 (s GPT-5.5 stále dostupným) v rámci limitů použití. Gemini Free spouští Gemini 3.6 Flash v aplikaci Gemini a Google AI Studio. Claude Free spouští Claude Sonnet 5 (nový výchozí) s denními limity. DeepSeek Chat spouští DeepSeek V4 zdarma na webu DeepSeeku. Grok má omezený bezplatný spotřebitelský plán (X Premium je placený doplněk). Qwen 3.5, NVIDIA Nemotron 3 Ultra, MiniMax M3, LongCat-2.0, Kimi K2.6, DeepSeek V4 a GLM-5.2 jsou open-weight a zdarma k self-hostingu. Qwen 3.7 Max je jen API bez spotřebitelského chatovacího rozhraní, ale Alibaba nyní zahrnuje 200 dotazů na model zdarma denně. Kimi má bezplatnou základní úroveň ve své aplikaci, s měřeným náročnějším agentickým použitím.
Co je Gemini Spark a stojí za $99.99/měsíc?
Gemini Spark je první AI agent Googlu běžící v cloudu 24/7, uvedený na Google I/O dne 19. května 2026 a exkluzivní pro plán Google AI Ultra, který Google přestrukturoval tak, aby zahrnoval vstupní úroveň za $99.99/měsíc a nejvyšší úroveň za $199.99/měsíc. Spark je postaven na základních modelech Gemini s harnessem Antigravity od Googlu na Google Cloud VM, integruje se s Gmailem, Google Docs a dalšími aplikacemi Google Workspace a na straně zařízení dokáže interagovat s Chromem a systémem Halo pro Android. Za tu výdaji stojí pro uživatele, kteří mají opakovatelné dlouhoběžící workflow (třídění schránky, souhrny výzkumu, plánované úlohy). Pro jednorázové úlohy pokryje Claude Cowork za $20/měsíc většinu potřeb desktopového agenta.
Co je Fello AI?
Fello AI je AI chatbot pro Mac, iPhone a iPad, který vám umožní používat všechny top AI modely jako ChatGPT, Claude, Gemini, Grok a DeepSeek v jedné aplikaci, s modely pravidelně aktualizovanými, takže máte vždy ty nejnovější. Stojí $9.99/měsíc s hodnocením 4,7 hvězdičky napříč 27 000+ recenzemi.
Jak často tuto stránku aktualizujete?
Tuto stránku aktualizujeme minimálně měsíčně a do 24-48 hodin od každého většího uvedení modelu.
Související články
Claude vs. ChatGPT: která AI je v roce 2026 opravdu lepší?

Claude se počátkem roku 2026 dostal na #1 v App Store a poprvé vytlačil ChatGPT ze špičky. Spouštěčem bylo veřejné odmítnutí Anthropicu vyhovět požadavku Pentagonu nasadit jeho modely pro autonomní zbraně.

Číst dál →
Grok vs. ChatGPT: který AI chatbot je v roce 2026 opravdu lepší?

Oba chatboti právě přešli na nové vlajkové modely. ChatGPT nyní běží na GPT-5.6 (úrovně Sol, Terra, Luna) a Grok pohání Grok 4.5, verze xAI zaměřená na programování z 8. července.

Číst dál →
ChatGPT vs. Gemini v roce 2026: kterou AI byste měli opravdu používat?

ChatGPT přešel na GPT-5.6 jako svůj vlajkový model, zatímco Gemini 3.1 Pro zůstává placeným vlajkovým modelem Googlu. Přímé srovnání napříč psaním, programováním, obrázky a cenou.

Číst dál →
Žebříčky nejlepší AI únor 2026

GPT-5.2, Claude Opus 4.6 a Gemini 3.1 Pro v přímém souboji. Naše měsíční podrobná analýza z února s benchmarky a praktickými výsledky.

Číst dál →
Nejlepší AI modely v lednu 2026

Gemini 3 Pro, Claude 4.5, ChatGPT (GPT-5.2), Grok 4.1 a DeepSeek v žebříčku. Náš měsíční lednový výběr 2026 napříč každým velkým modelem.

Číst dál →
Gemini Nano Banana Pro vs. GPT-Image-1.5: dokonalé srovnání

Naše původní praktické srovnání z prosince 2025 dvou vedoucích modelů pro generování obrázků, se skutečnými ukázkami výstupů vedle sebe.

Číst dál →

Vyzkoušejte každý model.
Jedna krásná aplikace.

Každý model z tohoto průvodce v jedné nativní aplikaci: ChatGPT, Claude, Gemini, Grok a DeepSeek. Začněte zdarma.

Fello AI běžící na Macu, iPadu a iPhonu

Hodnocení 4,7·27 000+ recenzí·Začněte zdarma