Záhada vyřešena: Ox Alpha je GLM-5.3-Flash. Vyšel pod MIT licencí a běžel celý na čínských čipech
Z.ai přiznala, že za anonymním modelem Ox Alpha stojí GLM-5.3-Flash. Je to MoE s 320 miliardami parametrů, z toho 18 aktivních, s milionovým kontextem a nativní prací s obrazem. Váhy vyšly pod MIT licencí, cena je 0,15 a 0,50 dolaru za milion tokenů, a celý ten stealth provoz běžel na sto tisících čínských čipech.
Máme rozuzlení. Před pár dny jsme tu psali o anonymním modelu Ox Alpha, který se objevil na OpenRouteru bez jediné zmínky o tom, kdo za ním stojí. Tehdy jsme uváděli, že technické otisky míří na čínskou laboratoř a favoritem je skrytá varianta GLM od Z.ai. Přesně tak to dopadlo. Z.ai, dřív známá jako Zhipu AI, potvrdila, že Ox Alpha byl celou dobu GLM-5.3-Flash.

A protože se k tomu rovnou pojí zveřejnění vah i pár čísel, které stojí za pozornost, je z toho jeden z nejzajímavějších příběhů letošního léta.
Co je GLM-5.3-Flash zač
Je to MoE model s 320 miliardami parametrů celkem, z nichž se na požadavek aktivuje jen 18 miliard. Kontext má 1 milion tokenů a je to první model řady GLM-5, který nativně zpracovává i obraz, tedy nejen text, ale i obrázky a video.
Ta architektura vysvětluje, proč model působil tak svižně. Osmnáct miliard aktivních parametrů je na dnešní poměry málo, takže odpovídá rychle a levně, ale díky celkové kapacitě 320 miliard si drží kvalitu, kterou by model o velikosti osmnácti miliard nikdy neměl.
MIT licence, tedy žádné malé písmo
Tohle je podle nás nejdůležitější část celého oznámení. Z.ai vydala váhy na Hugging Face pod licencí MIT. Ne pod vlastní licencí s podmínkami, ne s výjimkami podle obratu, ale pod jednou z nejotevřenějších licencí, jaké existují.
Stojí za to si to postavit vedle Kimi K3, o kterém jsme psali před měsícem. Tam byly váhy sice ke stažení, ale pod vlastní licencí, kde provozovatelé nad 20 milionů dolarů obratu potřebují zvláštní smlouvu. Tady nic takového není. Stáhnete, provozujete, prodáváte, hotovo. Pro firmy, které řeší právní jistotu, je to rozdíl mezi "možná" a "můžeme".
Výkon a cena, kde to začne být absurdní
Na Terminal-Bench 2.1 dosáhl GLM-5.3-Flash 84,3 bodu. To je víc než DeepSeek-V4-Flash s 82,7 a jen 0,7 bodu pod Claude Opus 4.8. Tedy model, který si můžete stáhnout a provozovat u sebe, šlape na paty placené špičce.
A teď ta cena. GLM-5.3-Flash stojí 0,15 dolaru za milion vstupních a 0,50 za milion výstupních tokenů, cachovaný vstup jen 0,03. Do 9. září navíc běží zaváděcí sleva 50 procent, takže reálně 0,075 a 0,25 dolaru.
Pro srovnání, Opus 4.8, se kterým se model měří na Terminal-Benchi, stojí 5 a 25 dolarů. To je zhruba třicetkrát až padesátkrát víc. A oproti Fable 5.1 s deseti a padesáti dolary je ten rozdíl ještě dramatičtější.
Samozřejmě, jeden benchmark nedělá model a Opus i Fable vedou v jiných disciplínách. Ale ta tabulka cena versus výkon se za poslední rok proměnila k nepoznání.
Nejsilnější část příběhu: čínské čipy
A tady je věc, která se v titulcích trochu ztratila, ale je možná nejdůležitější. Celý ten stealth provoz, kdy model obsluhoval podle Z.ai zátěž v řádu sta bilionů tokenů denně, běžel na clusteru sta tisíc domácích čínských čipů. Žádná Nvidia.
To je něco jiného než prohlášení do médií. Je to praktický důkaz, že se dá na čínském křemíku nejen trénovat, ale i provozovat model frontier úrovně v obřím měřítku. Zapadá to do širšího posunu, kdy Čína přidala domácí AI čipy na oficiální seznam pro státní nákupy a od firem jako Huawei nebo Cambricon se čeká, že brzy pokryjí drtivou většinu tuzemského trhu. Akcie Zhipu po oznámení poskočily nahoru, což o vnímání téhle zprávy taky něco vypovídá.
Když jsme psali o pronájmu výpočetní kapacity od SpaceX, končili jsme tím, že compute je nejvzácnější surovina oboru a drží ho pár hráčů. Tohle je první vážný signál, že ta závislost nemusí být trvalá.
Proč ten stealth launch vyšel
V původním článku jsme popisovali, proč laboratoře posílají modely ven anonymně: dostanou zpětnou vazbu z reálného provozu zdarma, srovnání bez předsudků a rozruch bez rizika. GLM-5.3-Flash je učebnicová ukázka, že to funguje. Model si bez loga vysloužil pozornost i uznání čistě za výkon, a teprve pak si Z.ai řekla o kredit.
Mimochodem, ta virální čísla z komunitního testu na deseti úlohách, u kterých jsme tehdy nabádali k opatrnosti, se v hrubých obrysech potvrdila. Nadšení bylo oprávněné, i když správné bylo počkat si na pořádná měření.
Co si z toho vzít
- Otevřené modely dorovnávají špičku a přestávají mít háčky. MIT licence u modelu, který si troufá na Opus 4.8, je změna oproti tomu, na co jsme zvyklí. Tady opravdu není co číst v malém písmu.
- Přepočítejte si, co vás dnes stojí rutina. Pokud u nějaké úlohy platíte prémiovou sazbu za model, který dělá běžnou práci, tenhle typ modelu je vážný kandidát na otestování. Rozdíl v ceně za úlohu je řádový, ne procentní.
- Ale pořád platí to, co u každého modelu odjinud. Než tam pošlete klientská data, vyřešte, kde model běží a kdo k datům má přístup. Otevřené váhy tuhle otázku řeší elegantně: můžete si ho pustit u sebe.
- Závislost na jednom dodavateli čipů není přírodní zákon. Sto tisíc domácích čipů obsluhujících frontier model je signál, který by měl zajímat každého, kdo plánuje na roky dopředu.
Z anonymního experimentu se za deset dní stal otevřený model s MIT licencí, cenou za desetinu konkurence a důkazem, že to jde i bez amerického hardwaru. Docela slušná bilance na model, který se ještě nedávno bál přiznat ke jménu. 🐂
Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.
Související
Máte nápad?
Vytvořme ho spolu.
Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.
