Aktualizace, 28. července 2026: GLM 5.2 už není nejsilnějším modelem s otevřenými váhami. Kimi K3 vydal své váhy 27. července 2026 a v žebříčku Artificial Analysis Intelligence Index ho překonává poměrem 57 ku 51. GLM 5.2 si udržuje reálnou výhodu v licencování a hardwaru a sekce s benchmarky níže byla přepracována.

GLM 5.2 dorazilo 13. června 2026 se třemi klíčovými čísly. Je to návrh Mixture-of-Experts se 744 miliardami parametrů a kontextovým oknem o 1 milionu tokenů pod licencí MIT, díky které si váhy může kdokoli zdarma stáhnout a spustit. Čínská AI laboratoř Zhipu AI (působící jako Z.ai) ho vydala jako špičkový model zaměřený primárně na kódování a načasování nebylo nenápadné. Vyšlo jen dva dny poté, co USA nařídily Anthropic omezit zahraniční přístup k jeho modelům Fable 5 a Mythos 5. Chcete-li širší obraz, podívejte se, jak si GLM stojí proti dalším předním modelům, jako jsou Claude, GPT a Gemini.

GLM 5.2 už není nejlépe hodnoceným otevřeným modelem, ale stále je tím, po kterém by většina lidí měla sáhnout. Náš přehled nejlepších open source AI modelů nyní staví Kimi K3 na první místo v čisté schopnosti, zatímco GLM 5.2 zůstává praktickou volbou jako nejsilnější tamní model nesoucí prostou licenci MIT. Pokud je pro vás samotná kategorie nová, náš výklad o tom, co je open source AI, popisuje, jak vlastně otevřené váhy a licencování modelů fungují. Níže najdete specifikace, čím se liší od GLM 5.1, benchmarky proti rivalům, jako je Seed 2.1 Pro od ByteDance, a kolik GLM Coding Plan doopravdy stojí.

To hlavní ve zkratce

  • GLM 5.2 bylo uvedeno 13. června 2026 jako model Mixture-of-Experts se 744 miliardami parametrů a 40 miliardami aktivních parametrů na token.
  • Kontextové okno o 1 milionu tokenů je zhruba 5× větší než limit ~200K u GLM 5.1, s výstupem až 131 072 tokenů.
  • Vychází pod licencí MIT, s otevřenými váhami, samostatným API a chatbotem Z.ai, který dorazil týden po uvedení.
  • Ceny GLM Coding Planu začínají na $18/měsíc (Lite), Pro je za $72/měsíc a Max za $160/měsíc, přičemž roční platba znamená slevu 20 %.
  • GLM 5.2 dosahuje 62,1 na SWE-bench Pro a 81,0 na Terminal-Bench 2.1, před GPT-5.5 a za Claude Opus 4.8, ale Kimi K3 mezitím převzal vedení mezi otevřenými váhami.

Co je GLM 5.2?

Od vydavatele

Každý AI model v jedné aplikaci

Fello AI přináší GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 a další v jedné nativní aplikaci pro Mac a iPhone.

Stáhnout hned!

GLM 5.2 je nejnovější vlajkový velký jazykový model od Zhipu AI, laboratoře se sídlem v Pekingu, která se stala jedním z nejagresivnějších vydavatelů modelů s otevřenými váhami v Číně. Je to nejnovější vydání v celé rodině modelů GLM od Zhipu. Je postaven na základu GLM-5 a používá architekturu Mixture-of-Experts s 744 miliardami celkových parametrů, z nichž se pro daný token aktivuje jen 40 miliard. Tento návrh drží provozní náklady blíže modelu o velikosti 40B, přičemž čerpá ze znalostí mnohem většího modelu.

Vydání míří přímočaře na vývojáře. Zhipu GLM 5.2 vypozicovalo kolem dlouhodobého kódování a agentní práce, tedy vícekrokových úloh, kde model píše, spouští a upravuje kód napříč celým projektem. Připojuje se k oblíbeným programovacím klientům přes koncový bod kompatibilní s Anthropic, takže nástroje jako Claude Code, Cline, OpenCode a OpenClaw na něj mohou mířit bez proprietárního SDK.

Jedna věc se po uvedení rychle změnila. Zhipu vydalo GLM 5.2 bez zveřejněných skóre v benchmarcích, jak upozornilo pokrytí uvedení od MarkTechPost, takže rané tvrzení „poráží GPT-5“ zůstalo jen prohlášením výrobce. Během několika dní tuto mezeru zaplnili nezávislí testeři a technická karta společnosti a čísla se usadila výrazně nad dřívějším GLM 5.1, které dosáhlo 58,4 na SWE-bench Pro. Kompletní výsledky jsou v sekci s benchmarky níže.

GLM 5.2 vs GLM 5.1: co se změnilo

Skok z GLM 5.1 (vydáno 7. dubna 2026) na GLM 5.2 je na papíře postupný, ale v jednom rozměru zásadní, a to v kontextu. Nový model zvládne pětkrát více vstupu, což mění, co mu můžete předložit v jediném promptu. Zde je srovnání vedle sebe.

SpecifikaceGLM 5.2GLM 5.1Co se změniloProč na tom záleží
Datum vydání13. června 20267. dubna 2026~2 měsíce od sebeRychlý iterační cyklus
Parametry744B (40B aktivních)744B (40B aktivních)Beze změnyStejný výpočet na token
Kontextové okno1 000 000 tokenů~200 000 tokenů5× většíCelé repozitáře v jednom promptu
Maximální výstup131 072 tokenů~128K tokenůZhruba stejnéDlouhé generování kódu
Režimy uvažováníHigh a MaxJeden režimDvě úrovně úsilíLadění hloubky vs cena
LicenceMIT (váhy vydány)MITBeze změnyPlně otevřené váhy
SWE-bench Pro62,158,4+3,7 boduSilnější kódování

Dva režimy uvažování jsou nové a praktické. High zvládá běžné generování, zatímco Max je nastavení, které Zhipu doporučuje pro složité vícekrokové kódování, kdy vyměňuje rychlost za hlubší uvažování. Počet parametrů se mezi oběma vydáními nezměnil. Obě mají 744B celkem s 40B aktivními, takže náklady na inferenci na token jsou beze změny. Co Zhipu změnilo, je architektura kolem toho. Karta modelu jmenuje IndexShare, který znovu využívá jeden indexer napříč každými čtyřmi řídkými pozornostními vrstvami a snižuje FLOPy na token 2,9× při kontextu 1 milionu tokenů. Zmiňuje také vylepšenou vrstvu MTP pro spekulativní dekódování, která zvyšuje délku akceptace až o 20 %.

Benchmarky GLM 5.2: jak si skutečně vede

Uvedení nechalo díru, ale data ji rychle zaplnila. Vlastní technická karta Zhipu i nezávislí testeři staví GLM 5.2 blízko uzavřené špičce v dlouhodobém kódování. Na některých testech se mezera vůči Claude Opus 4.8 zužuje zhruba na jediný bod, jak podrobně popisuje pokrytí od The Decoder. Toto rámování se od té doby posunulo dvakrát. Claude Opus 5 nahradil Opus 4.8 jako vlajkový model Anthropic 24. července 2026 a vede v žebříčku Artificial Analysis Intelligence Index s 61 a Kimi K3 převzal vedení mezi otevřenými váhami s 57 proti 51 u GLM 5.2. Tabulka níže zachovává srovnání, které Zhipu skutečně provedlo, proti Opus 4.8 a GPT-5.5.

BenchmarkGLM 5.2Claude Opus 4.8GPT-5.5GLM 5.1
SWE-bench Pro (kódování)62,169,258,658,4
Terminal-Bench 2.1, Terminus-2 (agentní)81,0858463,5
FrontierSWE (dlouhodobé)74,4 %75,1 %72,6 %

Vynikajícím výsledkem je SWE-bench Pro, kde 62,1 u GLM 5.2 poráží GPT-5.5 s 58,6 i svého vlastního předchůdce s 58,4, zatímco za Claude Opus 4.8 s 69,2 zaostává. Na Terminal-Bench 2.1 vyskočilo na 81,0 z 63,5 u GLM 5.1 na testovacím prostředí Terminus-2 a na FrontierSWE sedí necelý bod za Opus 4.8, přičemž těsně předstihuje GPT-5.5. Volba testovacího prostředí má větší význam, než by se zdálo. Artificial Analysis, které samo provozuje Terminal-Bench 2.1, hodnotí GLM 5.2 na 77,9 proti 85,0 u Kimi K3 a 84,6 u Opus 4.8, takže každé jednotlivé číslo čtěte s uvedeným testovacím prostředím. Dosahuje také 99,2 % v matematickém testu AIME 2026. Pro kontext, jak daleko dokáže tato čísla posunout orchestrace, Fugu od Sakana AI dosahuje 73,7 na SWE-Bench Pro tím, že úlohy směruje napříč skupinou modelů, místo aby běželo jako jeden.

Skutečným titulkem je ekonomika. GLM 5.2 se v těchto programovacích maratonech vyrovná GPT-5.5 nebo ho poráží za zhruba šestinu ceny. To ho posouvá z levné alternativy na vážného konkurenta. Jedna hvězdička přichází od nezávislé platformy Artificial Analysis, která zjistila, že model k dosažení těchto skóre spotřebuje mnohem více tokenů než rivalové, což z něj dělá jednu z méně tokenově úsporných možností ve své třídě. Zhipu tuto spotřebu přímo zpoplatňuje. V Coding Planu se využití GLM 5.2 odečítá 3× během špičkových hodin a 2× mimo špičku, s časově omezenou sazbou 1× mimo špičku platnou do konce září. V náročných jednorázových testech uvažování, jako je Humanity's Last Exam, stále zaostává za Opus 4.8 a Gemini 3.1 Pro o několik bodů, takže je to v první řadě specialista na kódování a agenty.

Proč na kontextovém okně o 1 milionu tokenů záleží

Kontextové okno o 1 milionu tokenů znamená, že GLM 5.2 udrží najednou zhruba 750 000 slov vstupu. V praxi můžete vložit celou středně velkou kódovou základnu, kompletní sadu API dokumentace nebo dlouhý výzkumný korpus a požádat model, aby nad tím vším uvažoval bez rozdělování na části. Model je označen glm-5.2[1m], aby signalizoval rozšířené okno, a Z.ai popisuje tuto kapacitu jako „použitelnou“, nikoli jako marketingový strop.

Konkrétně u kódování je to rozdíl mezi tím, zda modelu předložíte jeden soubor, nebo celý repozitář. Agentní nástroje, které dříve musely projekt shrnovat nebo z něj získávat části, teď udrží v pracovní paměti mnohem více. To snižuje chyby, které se vkrádají, když model ztratí přehled o kódu, který nevidí. Tato síla v dlouhém kontextu je stejným důvodem, proč se otevřené modely stavěné pro běh na Macu staly populárními u vývojářů, kteří chtějí lokální kontrolu.

GLM 5.2 a pozadí exportních kontrol

Na datu uvedení záleží. V dnech těsně před oznámením GLM 5.2 americká ministryně obchodu nařídila Anthropic zablokovat zahraniční přístup k Fable 5 a Mythos 5 do 48 hodin na základě nové direktivy o exportních kontrolách. Anthropic oba modely během několika hodin globálně vypnul a kompletní časovou osu si můžete přečíst v našem pokrytí vypnutí Fable 5.

Zhipu GLM 5.2 zarámovalo jako přímou protiváhu. Vydáním modelu špičkové úrovně pod licencí MIT bez regionálních omezení společnost nabídla otevřené váhy jako pojistku proti tomu, aby zakladatelskou AI ovládal jediný stát nebo dodavatel. Investoři zareagovali rychle a akcie Zhipu po oznámení open source vzrostly, jak uvádí South China Morning Post. Je to součást širší vlny čínských otevřených vydání, která zahrnuje rodinu Qwen a DeepSeek V4.

Ceny a dostupnost GLM 5.2

GLM 5.2 bylo okamžitě dostupné napříč všemi úrovněmi GLM Coding Planu, přičemž samostatné API, chatbot Z.ai a stažitelné váhy MIT byly vydány v týdnu po uvedení. Coding Plan je předplatné, které směruje přes stejný koncový bod kompatibilní s Anthropic, účtuje se měsíčně a roční platba znamená slevu 20 % z každé úrovně. Každá úroveň je měřena v promptech, v klouzavém 5hodinovém okně a s týdenním stropem.

GLM Coding Plan Lite ($18/měsíc)

Vstupní úroveň stojí $18/měsíc, neboli $172.80 za rok, což vychází na $14.40/měsíc. Pokrývá zhruba 80 promptů každých 5 hodin a asi 400 týdně, což vyhovuje jednotlivým vývojářům provádějícím mírnou asistenci při kódování. Je to nejlevnější způsob, jak GLM 5.2 vyzkoušet uvnitř nástroje jako Claude Code.

GLM Coding Plan Pro ($72/měsíc)

Pro běží za $72/měsíc, neboli $691.20 za rok při $57.60/měsíc, a zvedá strop zhruba na 400 promptů každých 5 hodin a 2 000 týdně. Míří na náročné uživatele, kteří denně provádějí vícesouborové refaktoringy a agentní úlohy.

GLM Coding Plan Max ($160/měsíc)

Max stojí $160/měsíc, neboli $1,536 za rok při $128/měsíc, a umožňuje zhruba 1 600 promptů každých 5 hodin a 8 000 týdně, pro vývojáře, kteří nechávají agenta běžet celý pracovní den. Cena pro týmy je pro organizace podle počtu míst. Pro představu, jak si to stojí proti konkurenčním otevřeným modelům, náš rozbor Rio 3.5 Open popisuje další čínské vydání s otevřenými váhami, které stojí za srovnání.

Měli byste používat GLM 5.2?

Pokud píšete kód a chcete model s dlouhým kontextem, který si můžete provozovat sami, GLM 5.2 je nejsilnější otevřeně dostupný model nesoucí prostou licenci MIT, která odstraňuje obvyklá omezení komerčního použití. Kimi K3 dosahuje vyššího skóre, ale vychází pod vlastní licencí Moonshot a ke stažení váží 1,56 TB proti 1,51 TB u GLM 5.2. Kontext o 1M tokenů je reálnou výhodou pro práci v měřítku repozitáře a koncový bod kompatibilní s Anthropic znamená, že ho můžete zasadit do stávajících nástrojů s minimálním třením.

Benchmarky otázku výkonu vyřešily, takže skutečnými úvahami jsou teď podoba nákladů a datová jurisdikce. GLM 5.2 je náročný na tokeny, což znamená, že intenzivní agentní použití může navýšit spotřebu rychleji, než napovídá uváděná cena. A přestože vám otevřené váhy umožňují self-hosting s plným soukromím, směrování přes hostované API Z.ai posílá váš kód na servery řídící se čínskými pravidly pro data. To je kompromis, který stojí za zvážení u citlivé nebo proprietární práce. Pokud byste raději modely nespravovali vůbec, aplikace jako Fello AI vám dají Claude, ChatGPT, Gemini, Grok a DeepSeek přes jediné předplatné za $9.99/měsíc. Můžete porovnávat výstupy, aniž byste žonglovali se samostatnými účty nebo API klíči. Samotné GLM 5.2 se do této nabídky přidalo v aktualizaci Fello AI 6.7.0.

Závěr

GLM 5.2 je jasným prohlášením, model špičkové úrovně s kontextem 1M a licencí MIT vydaný během několika dní po zásadním americkém exportním zásahu. A na rozdíl od doby uvedení teď čísla toto rámování podpírají. Poráží GPT-5.5 na SWE-bench Pro a v dlouhodobých úlohách se přibližuje na bod ke Claude Opus 4.8, to vše za zhruba šestinu ceny. Co se od té doby změnilo, je společnost, ve které se pohybuje, protože Kimi K3 je teď před ním v žebříčcích otevřených vah a Claude Opus 5 je před Opus 4.8 na uzavřené straně. Zbývajícími výhradami jsou jeho vysoká spotřeba tokenů a otázka datové jurisdikce kolem hostovaného API. Pokud ho chcete vyzkoušet hned, nejlevnější cestou je $18/měsíc GLM Coding Plan Lite přes nástroj jako Claude Code, přičemž otevřené váhy jsou nyní k dispozici pro self-hosting. Další vydání Zhipu, GLM 5.5, se už očekává později v roce 2026.

FAQ

Je GLM 5.2 zdarma?

Váhy jsou vydány pod licencí MIT, takže self-hosting je zdarma a bez omezení pro komerční použití. Použití přes GLM Coding Plan stojí od $18/měsíc, zatímco samostatné API běží za $1.40 za milion vstupních tokenů, $0.26 při zásahu do cache a $4.40 za milion výstupních.

Jak velké je kontextové okno GLM 5.2?

Zvládá až 1 000 000 vstupních tokenů, zhruba pětkrát více než limit ~200 000 tokenů u GLM 5.1, s výstupem až 131 072 tokenů.

Kdo vytvořil GLM 5.2?

Zhipu AI, laboratoř se sídlem v Pekingu působící jako Z.ai, která je jedním z předních čínských vydavatelů modelů s otevřenými váhami.

Poráží GLM 5.2 GPT-5 nebo Claude?

V kódování zčásti ano. Benchmarky vydané po uvedení ukazují, že GLM 5.2 dosahuje 62,1 na SWE-bench Pro, před GPT-5.5 s 58,6, ale za Claude Opus 4.8 s 69,2. Zhruba měsíc byl nejsilnějším dostupným modelem s otevřenými váhami. Kimi K3 ho v červenci 2026 předstihl a uzavření lídři včetně Claude Opus 5 si stále drží jasný náskok v nejtěžších dlouhodobých úlohách.

Můžu GLM 5.2 používat s Claude Code?

Ano. GLM 5.2 vystavuje koncový bod kompatibilní s Anthropic, takže Claude Code, Cline, OpenCode a podobné nástroje se k němu mohou připojit přímo.