8. července 2026 vydal xAI Grok 4.5, první model určený specificky pro kódování a agentní práci. Nejde o obecné zlepšení schopností. Jde o záměrný obrat směrem k vývojářům, přičemž trénování probíhalo na reálných datech z vývojářských relací v Cursor a benchmarky jsou navrženy tak, aby měřily, co AI dokáže skutečně dělat v reálném kódu v průběhu dlouhé relace. 12. srpna 2026 jej nahradil Grok 4.6, vylepšení po tréninku na stejném základu.

Výsledkem je model, který dosahuje skóre 56 na Artificial Analysis Intelligence Index, čímž překonává každý model Gemini, a to za zlomek ceny, za kterou dnes funguje špičkový model fronty. Artificial Analysis stálo prohnání Grok 4.5 přes index 0,36 $, zatímco GPT-5.6 Sol vyšel na 1,23 $ a Claude Opus 5 s maximálním uvažováním na 2,34 $.

Elon Musk ho zařadil přímo: „Je to model třídy Opus, ale rychlejší, efektivnější co do tokenů a levnější." V navazujícím příspěvku byl přesnější: „Grok 4.5 je zhruba srovnatelný s Opus 4.7, ale mnohem rychlejší."

Musk také naznačil, že aktuální rychlosti nejsou stropem. xAI zatím nenasadil interně vyvinutý inferenční zásobník v C/C++, který přímo mapuje na hardware GB300, a jakmile to udělá, očekává zdvojnásobení rychlosti nebo více. Signalizoval další výrazné vydání na následující měsíc; k 10. srpnu 2026 nic nevyšlo a grok-4.5-latest je stále aktuálním aliasem v seznamu modelů xAI.

Klíčové poznatky

  • Grok 4.5 byl spuštěn 8. července 2026 a dosahuje skóre 56 na Artificial Analysis Intelligence Index v4.1.1, čímž překonává každý model Gemini. Při spuštění se umístil na 4. místě a nyní je 15. ze 185 záznamů.
  • Postaven na základním modelu V9 s 1,5 biliony parametrů a trénovaný na reálných datech relací v Cursor pro kódování a agentní úlohy.
  • Cena je 2 $ / 6 $ za milion tokenů, přičemž mezipaměťový vstup je za 0,30 $, zatímco aktuální Claude Opus 5 stojí 5 $ / 25 $. Na Artificial Analysis je to nejlevnější model v top 15 při prohánění přes Intelligence Index.
  • Velmi efektivní co do tokenů: na každou úlohu Intelligence Index využívá přibližně 14 000 výstupních tokenů oproti 67 020 u Opus 4.8 v porovnání xAI ke dni spuštění.
  • Musk ho nazývá „modelem třídy Opus, ale rychlejším" a očekává, že vlastní inferenční zásobník zdvojnásobí současných přibližně 80 tokenů/s.

Co Grok 4.5 ve skutečnosti je

Od vydavatele

Každý AI model v jedné aplikaci

Fello AI přináší GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 a další v jedné nativní aplikaci pro Mac a iPhone.

Stáhnout hned!

Grok 4.5 je první model xAI trénovaný od základu pro kódování a agentní úlohy místo pro obecnou inteligenci. Postaven na základním modelu V9 s 1,5 biliony parametrů byl trénován ve spolupráci s Cursor, aby zvládal dlouhotrvající práci napříč více repozitáři a fungoval s minimálním lidským zásahem po stovkách volání nástrojů. Toto partnerství později vyústilo v agentní produkt SpaceXAI, který stejný přístup přenáší do desktopové aplikace.

Hlavní specifikace jsou přímočaré.

SpecifikaceDetail
Název modelu v APIgrok-4.5
ArchitekturaZákladní model V9, 1,5 bilionu parametrů (3× větší než V8 modelu Grok 4.3)
Kontextové okno500 000 tokenů
Rychlostpřibližně 80 tokenů za sekundu
Vstupní modalitytext a obrázky (vision)
Uvažováníkonfigurovatelné na nízké, střední, vysoké nebo xhigh úsilí (výchozí: vysoké)
Podporovaná APIResponses API a Chat Completions
Vestavěné schopnostivolání funkcí, vyhledávání na webu, vyhledávání na X, spouštění kódu

Označení V9 signalizuje úplnou generační změnu oproti sérii V8, která pohání Grok 4.3: měřítko se ztrojnásobilo a zaměření trénování se zcela přesunulo na kódování a agentní úlohy. Kontextové okno se zkrátilo z 1 milionu tokenů u Grok 4.3 na 500 000, což je skutečný kompromis pro každého, kdo potřeboval celý milion.

Spojení s Cursor

Formulace „trénovaný s Cursor" v oznámení není jen marketingovým partnerstvím. V polovině června 2026 SpaceX získal Cursor přibližně za 60 miliard dolarů, čímž dostal jeden z nejrozšířenějších AI editorů kódu přímo do ekosystému xAI. Právě tato akvizice je důvodem, proč trénování Grok 4.5 zahrnovalo reálná data z vývojářských relací v Cursor, čímž xAI získal přímý přístup ke skutečným pracovním postupům, vzorcům kontextu a strukturám dlouhodobých úloh, které vývojáři v praxi používají.

Na rozdíl od trénování na veřejných repozitářích kódu reálná data relací zachycují, jak vývojáři iterují nad problémem, přepínají kontext napříč soubory a dělají vícekroková rozhodnutí v rámci skutečných projektů. Grok 4.5 je první model, který toto odráží.

xAI zároveň s tímto modelem zavedl novou metodologii trénování, asynchronní učení, která umožňuje vícahodinové agentní tréninkové běhy probíhat souběžně s průběžným trénováním modelu, nikoli sekvenčně. Praktickým výsledkem je, že zpětnovazební smyčky mezi chováním modelu a jeho tréninkovými aktualizacemi jsou mnohem kratší, což modelu umožňuje zvládat druh dlouhotrvajících autonomních relací, na kterých většina agentů aktuálně uvízne.

Výsledky benchmarků

Benchmarky xAI zveřejněné při spuštění

BenchmarkFable 5GPT-5.5Grok 4.5Opus 4.8GLM-5.2
DeepSWE 1.066,1 %64,3 %62,0 %55,8 %n/a
DeepSWE 1.170,0 %67,0 %53,0 %59,0 %44,0 %
Terminal-Bench 2.184,3 %83,4 %83,3 %78,9 %n/a
SWE-Bench Pro80,4 %n/a64,7 %69,2 %62,1 %

Toto jsou čísla, která xAI zveřejnil 8. července 2026, měřená oproti modelům aktuálním v ten den. Přímé čtení: Grok 4.5 poráží Opus 4.8 ve dvou ze čtyř benchmarků (DeepSWE 1.0 a Terminal-Bench 2.1) a zaostává ve dvou dalších (DeepSWE 1.1 a SWE-Bench Pro). Claude Fable 5 vede ve všech čtyřech a na Terminal-Bench 2.1 je rozdíl mezi Grok 4.5 (83,3 %) a GPT-5.5 (83,4 %) pouhá desetina procenta. Opus 4.8 a GPT-5.5 byly od té doby překonány Claude Opus 5 a GPT-5.6 Sol, přičemž xAI proti nim žádná čísla nezveřejnil, takže pro nákupní rozhodnutí je relevantní níže uvedená část o aktuálním stavu.

Nezávislé benchmarky od Artificial Analysis

Na Artificial Analysis Intelligence Index, nyní ve verzi v4.1.1, dosahuje Grok 4.5 s vysokým uvažováním skóre 56. Grok 4.3 dosahuje skóre 37 při středním uvažování na stejném žebříčku, což z tohoto skoku dělá největší mezigenerační skok, který xAI na tomto indexu zaznamenal, a Grok 4.5 stále překonává každý model Gemini; nejlepší z nich, Gemini 3.6 Flash, je na 52. Samotné skóre se v srpnu přesunulo ze 54 na 56, protože Artificial Analysis přehodnotil celý žebříček nahoru ve verzi v4.1.1, nikoli proto, že by se model změnil.

Jeho pozice se však posunula a to stojí za jasné vyjádření. Grok 4.5 se při spuštění 8. července umístil čtvrtý ze 168 záznamů. Na dnešním žebříčku je 15. ze 185, přičemž nad ním skórují Claude Opus 5, Claude Fable 5, GPT-5.6 Sol, Kimi K3, Qwen3.8 Max, Muse Spark 1.2 a GPT-5.6 Terra. Claude Opus 4.8, oproti kterému byl Grok 4.5 benchmarkován při spuštění, již na žebříčku vůbec není. Skóre nekleslo, pole se posunulo.

Jedno tvrzení ze dne spuštění se obrátilo. Grok 4.5 již nepřekonává každý model s otevřenými váhami, protože Kimi K3 zveřejnil otevřené váhy 27. července 2026 a dosahuje skóre 60 na stejném indexu.

Na GDPval-AA v2, benchmarku měřícím trvalou agentní znalostní práci, dosahuje Grok 4.5 Elo skóre 1 543, čímž předstihuje GLM-5.2 na 1 513 a zaostává za Claude Opus 4.8 na 1 600. Při spuštění se umístil čtvrtý, ale Claude Opus 5 od té doby na stejném benchmarku dosáhl 1 861, takže i tato pozice se posunula. V nejtěžší dílčí úloze finančního uvažování, tau3-Banking, dosahuje Grok 4.5 33 %, což je nejvyšší skóre ze všech hodnocených modelů a překonává GPT-5.5 (xhigh) s 31 %.

Na Artificial Analysis Coding Agent Index (kombinace DeepSWE, Terminal-Bench v2 a SWE-Atlas QnA) dosahuje Grok 4.5 v harnessu Grok Build skóre 76 a umísťuje se třetí. Je srovnatelný s GPT-5.5 (xhigh) v Codex a nachází se těsně pod Fable 5 (max) v Claude Code.

xAI také uvádí Harvey Legal Agent Benchmark, kde Grok 4.5 obsadil první místo. V kombinaci s nejvyšším skóre tau3-Banking to ukazuje na právní a finanční znalostní práci jako na specifické silné stránky nad rámec toho, co samotné benchmarky kódování zachytí.

Výsledky benchmarků od Artificial Analysis [zdroj]

Efektivita tokenů

Cena za token je to, co zaujme, ale efektivita tokenů je smysluplnější číslo. Na SWE-Bench Pro použil Grok 4.5 přibližně 15 954 výstupních tokenů na úlohu oproti 67 020 u Opus 4.8, tedy 4,2× méně. Na Artificial Analysis Intelligence Index využívá přibližně 14 000 výstupních tokenů na úlohu, o více než 60 % méně než Opus 4.8. Na Coding Agent Index průměrně spotřebuje 1,9 milionu tokenů celkem na úlohu, oproti 7,2 milionu u Fable 5 v Claude Code a 6,2 milionu u GPT-5.5 v Codex.

Model, který použije 4× méně tokenů, není jen levnější na úlohu. Je rychlejší a generuje méně šumu v agentních pipelinách, což má význam při vícekrokové autonomní práci.

Ceny a náklady na úlohu

Grok 4.5 je oceněn na 2,00 $ za milion vstupních tokenů a 6,00 $ za milion výstupních tokenů. Zásahy do mezipaměti jsou zlevněny o 85 %, čímž se mezipaměťové vstupní tokeny dostanou na 0,30 $ za milion. Důležitá výhrada: cena se zdvojnásobuje pro vstupy delší než 200 000 tokenů. Úplný přehled cen předplatného a API Grok, včetně spotřebitelských úrovní, obsahuje tento průvodce se všemi možnostmi.

Ve srovnání s aktuální frontou je to hluboko pod polovinou toho, co účtuje Claude Opus 5 za 5 $ / 25 $. Ale náklady na úlohu jsou smysluplnějším číslem, protože zohledňují, kolik tokenů každý model skutečně spotřebuje. Tabulka níže uvádí čísla xAI a Artificial Analysis zveřejněná ke dni spuštění v červenci 2026.

ModelVstup (za 1M)Výstup (za 1M)Cena za úlohu Intelligence IndexCena za úlohu Coding Agent
Grok 4.5$2.00$6.00$0.31$2.49
GPT-5.5 (Codex)$5.00$30.00vyšší$5.07
Fable 5 (Claude Code)$10.00$50.00vyšší$11.80
Opus 4.8$5.00$25.00vyššín/a

Čísla za úlohu jsou ta, na kterých záleží v produkčním měřítku. Grok 4.5 dosáhl téměř rovnocenného výkonu coding agenta za zhruba polovinu ceny GPT-5.5 a méně než čtvrtinu ceny Fable 5 za dokončenou práci. Tato výhoda přetrvala i jak se pole posunulo. Na aktuálním Intelligence Index uvádí Artificial Analysis náklady na prohnání Grok 4.5 ve výši 0,36 $ oproti 1,23 $ u GPT-5.6 Sol a 2,34 $ u Claude Opus 5, obou s maximálním uvažováním.

Kde je Grok 4.5 dostupný

Grok 4.5 byl v den spuštění zpřístupněn napříč širokou sadou platforem. Je dostupný v API xAI pod názvem modelu grok-4.5, v Grok Build (vlastním harnessu kódovacího agenta xAI) a v Cursor napříč všemi plány. Přístup třetích stran zahrnuje OpenRouter, Vercel, Cloudflare, Snowflake a Databricks Mosaic. Je také dostupný v Fello AI na Macu, iPhonu a iPadu.

Spuštění pluginu pro Office stojí za zmínku. xAI se snaží Grok 4.5 umístit nejen jako model pro kódování, ale jako model pro znalostní práci schopný sestavovat složité excelové modely s integrovaným webovým výzkumem a generovat sofistikovaný obsah pro PowerPoint. To výrazně rozšiřuje adresovatelné použití daleko za hranice vývoje softwaru.

Mezera v EU se uzavřela. Grok 4.5 byl spuštěn ve 47 zemích, ale byl zablokován ve všech 27 členských státech EU, přičemž zpoždění bylo přičítáno compliance práci v rámci zákona EU o AI, který zachází s modely trénovanými nad 1025 FLOPs jako s těmi, které nesou systémové riziko. xAI otevřel přístup pro EU v průběhu července 2026 a jeho vývojářská dokumentace již nenese regionální omezení, které zobrazovala při spuštění.

Model podporuje formáty Responses API i Chat Completions, což znamená, že se bez úprav zapojí do kódových základen již postavených na API kompatibilních s OpenAI.

Co řekl Elon Musk

Musk kolem dne spuštění učinil několik prohlášení, která naznačují, kam tento model patří a kam směřuje.

O umístění z hlediska schopností: „Je to model třídy Opus, ale rychlejší, efektivnější co do tokenů a levnější," s navazujícím upřesněním, že je „zhruba srovnatelný s Opus 4.7, ale mnohem rychlejší." Tento poslední detail je důležitý. Musk porovnává s Opus 4.7, nikoli s 4.8, což nezávislá data v zásadě potvrzují.

O stropu rychlosti: „Grok 4.5 zatím nepoužívá náš interně vyvinutý inferenční software v C/C++, který přesně mapuje na hardware GB300. Zdvojnásobení nebo více oproti aktuální rychlosti je pravděpodobně dosažitelné." Aktuální propustnost kolem 80 tokenů za sekundu není konečným číslem. Vlastní inferenční zásobník je ve vývoji a přidá další rychlost bez změny vah modelu.

O tom, co bude dál: „Vydání příštího měsíce bude dalším výrazným skokem vpřed, jak uzavíráme smyčku řešení skutečných technických problémů v Tesla, SpaceX, Neuralink a Boring Company." Tato zpětnovazební smyčka z reálné inženýrské práce v sesterských společnostech xAI je zdroj tréninkových dat, který žádná jiná laboratoř nemá ve stejném měřítku.

O budoucích multimodálních schopnostech: Grok získá schopnost volat Grok Imagine jako nástroj v agentním režimu, přičemž generování obrázků a videí bude součástí delšího autonomního pracovního postupu, nikoli samostatnou funkcí. Musk označil tuto funkci za obzvláště hodnotnou pro vývojáře her.

Reakce prvních uživatelů

Zpětná vazba vývojářů z časného přístupu přes Cursor byla pozitivní. Danny Limanseta ho popsal jako „Opus 4.8 při dvojnásobné rychlosti a za výrazně nižší cenu" poté, co ho použil k brainstormingu, plánování a implementaci komplexní herní funkce v průběhu celé relace, aniž by ho musel v každém kroku ručně opravovat.

Artificial Analysis shrnul konkurenční posun v den spuštění úderně: Grok 4.5 „přivádí SpaceXAI na frontier inteligence těsně za OpenAI a Anthropic a překonává všechny modely s otevřenými váhami a výrazně modely Google Gemini." Část o otevřených vahách od té doby zastarala, jak je uvedeno výše.

Jak Grok 4.5 obstojí v porovnání s konkurencí

Oproti aktuální frontě Grok 4.5 jen zřídka obsadí první místo v absolutních schopnostech, ale konzistentně vítězí v ceně a efektivitě tokenů. Zde je srovnání model po modelu s použitím žebříčku Artificial Analysis v4.1.1 pro vše aktuální a čísel xAI ze dne spuštění tam, kde jsou jedinými zveřejněnými čísly.

Versus Grok 4.3

56 oproti 37 u Grok 4.3 je největším mezigeneračním skokem v linii Grok. Kontextové okno se zkrátilo na polovinu z 1M na 500k a vstupní modality se zúžily na text a obrázky, což jsou dva skutečné kompromisy. Pokud jste používali Grok 4.3 pro kódování, Grok 4.5 je ve všech ostatních dimenzích výrazným vylepšením.

Versus Claude Opus 5

Claude Opus 5 je aktuální vlajkový model Anthropic a vede Intelligence Index se skóre 63, o sedm bodů před Grok 4.5. Nabízí také kontextové okno 1M tokenů oproti 500k u Grok 4.5. Cenové srovnání vychází opačně, a to výrazně. Opus 5 je ceněn na 5 $ / 25 $ za milion tokenů oproti 2 $ / 6 $ a Artificial Analysis stálo prohnání Opus 5 přes index 2,34 $ oproti 0,36 $ u Grok 4.5. Pro nejtěžší otevřené kódovací práce má Opus 5 navrch; pro agentní pipeline, kde se cena na úlohu sčítá přes stovky volání nástrojů, vychází ekonomika lépe u Grok 4.5.

Versus Claude Fable 5

Fable 5 vede ve všech čtyřech benchmarcích xAI i na Intelligence Index. Cenový rozdíl je největší ze všech srovnání: 2,49 $ oproti 11,80 $ za úlohu Coding Agent, tedy téměř 5×. Pro pracovní zátěže, kde je nezbytný absolutně nejvyšší výkon kódování, je Fable 5 stále před ostatními. Pro výkon blízký frontě za zlomek ceny vítězí Grok 4.5.

Versus GPT-5.6 Sol

Sol je aktuální vlajkový model OpenAI a nejbližší srovnání na žebříčku. S maximálním uvažováním dosahuje skóre 61 a s vysokým 57, čímž je Grok 4.5 se svými 56 na jediný bod od Sol při vysokém nastavení. Odděluje je cena: Artificial Analysis prohnala Sol s maximálním uvažováním přes index za 1,23 $ oproti 0,36 $ u Grok 4.5. Pokud se rozhodujete podle hrubých schopností, vyhraje Sol; pokud se rozhodujete podle schopností na dolar ve velkém měřítku, vyhraje Grok 4.5.

Versus dvojice z dne spuštění: Opus 4.8 a GPT-5.5

Oba modely, oproti kterým byl Grok 4.5 benchmarkován v červenci, mají od té doby status legacy, ale čísla stojí za zachování, protože jde o jediná přímá srovnání zveřejněná xAI. Oproti Opus 4.8 Grok 4.5 vyhrál DeepSWE 1.0 a Terminal-Bench 2.1 a prohrál DeepSWE 1.1 a SWE-Bench Pro. Oproti GPT-5.5 byl rozdíl na Terminal-Bench 2.1 desetina procenta (83,3 % vs 83,4 %), Coding Agent Index skončil remízou a Grok 4.5 vedl na tau3-Banking o 2 body za přibližně poloviční cenu za úlohu (2,49 $ vs 5,07 $).

Versus GLM-5.2

Grok 4.5 je těsně před GLM-5.2 na GDPval-AA v2 (Elo 1 543 vs 1 513). Grok 4.5 vede na celkovém Intelligence Index i na tau3-Banking.

Srovnání benchmarků s ostatními předními modely [zdroj]

Proč toto vydání má váhu

Ze spuštění Grok 4.5 vynikají tři věci, které stojí za sledování nad rámec čísel benchmarků.

xAI dosáhl frontier inteligence. Grok 4.3 nesoutěžil s Anthropic a OpenAI na vrcholu žebříčků schopností se skóre 37 na Intelligence Index. Grok 4.5 ano, se skóre 56. To mění konkurenční strukturu trhu ze závodu dvou hráčů na trojstranný.

Případ cenové efektivity je reálný, nejde jen o cenový rabat. Grok 4.5 je levnější za token, ale je také dramaticky efektivnější co do tokenů na úlohu. Model, který produkuje stejný výstup za 14 000 tokenů, zatímco konkurent spotřebuje 67 000, není jen levnější na provoz, ale je rychlejší a generuje méně šumu v agentních pracovních postupech. Obojí má váhu v produkčním měřítku.

Strop rychlosti ještě nebyl dosažen. 80 tokenů za sekundu je aktuální číslo. Jakmile xAI nasadí vlastní inferenční zásobník v C/C++ namapovaný na hardware GB300, Musk očekává zdvojnásobení nebo více. Model již konkurenceschopný v ceně a kvalitě se výrazně zrychlí bez nutnosti aktualizace modelu.

Grok 4.5 je dostupný ve Fello AI, kde ho můžete spustit vedle Claude, ChatGPT, Gemini, DeepSeek a Perplexity v jedné nativní aplikaci pro Mac, iPhone a iPad a porovnat stejnou úlohu napříč každým frontier modelem na jednom předplatném místo správy samostatných účtů. Pro kontext o tom, co přijde po Grok 4.5, článek o Grok 5 pokrývá, co xAI naznačil o příští hlavní verzi.

Často kladené otázky

Kdy byl Grok 4.5 vydán?

xAI vydal Grok 4.5 8. července 2026. Je to první model xAI vytvořený specificky pro kódování a agentní práci, trénovaný na reálných datech z vývojářských relací v Cursor.

Kolik stojí Grok 4.5?

Cena API je 2,00 $ za milion vstupních tokenů a 6,00 $ za milion výstupních tokenů. Zásahy do mezipaměti dostávají slevu 85 %, čímž se mezipaměťový vstup sníží na 0,30 $ za milion. Cena se zdvojnásobuje pro vstupy delší než 200 000 tokenů.

Je Grok 4.5 lepší než Claude Opus 5?

Ne co do hrubých schopností. Claude Opus 5 dosahuje skóre 63 na Artificial Analysis Intelligence Index oproti 56 u Grok 4.5 a nabízí kontextové okno 1M tokenů oproti 500k. Grok 4.5 přesvědčivě vítězí v ceně, za 2 $ / 6 $ za milion tokenů oproti 5 $ / 25 $, a v efektivitě tokenů na dokončenou úlohu.

Jaké je kontextové okno Grok 4.5?

Grok 4.5 má kontextové okno 500 000 tokenů, tedy méně než 1 milion tokenů u Grok 4.3. Je to jediný zřejmý kompromis jinak celkového vylepšení.

Mohu Grok 4.5 použít ve Fello AI?

Ano. Grok 4.5 je dostupný ve Fello AI, takže ho můžete spustit vedle Claude, ChatGPT, Gemini, DeepSeek a Perplexity v jedné nativní aplikaci pro Mac, iPhone a iPad a porovnat stejnou úlohu napříč každým frontier modelem na jediném předplatném.