OpenAI srazila ceny GPT-6 na polovinu hodinu a půl po Anthropicu. Grafy ale srovnává s modelem, který mezitím zestárl
GPT-6 Sol stojí 2 a 10 dolarů za milion tokenů, Luna 0,10 a 0,50. Proti verzím 5.6 je to poloviční cena a OpenAI říká, že natrvalo. Všechna srovnání v oznámení ale míří na Claude Opus 5, ne na Opus 5.5, který vyšel devadesát minut předtím. Na jednom benchmarku, který hlásí obě firmy, ten rozdíl dělá sedm procentních bodů v neprospěch Solu.
Dneska ráno jsme psali o Claude Opus 5.5. Zhruba devadesát minut po tom oznámení vydala OpenAI GPT-6 Sol a GPT-6 Luna a srazila ceny na polovinu. Devatenáct dní po GPT-6 Astra.
Tohle není náhoda a nikdo nepředstírá, že by byla.

Ceník je ta hlavní zpráva
Obě varianty navazují na rodinu 5.6 a obě zlevnily zhruba o polovinu:
- GPT-6 Sol: 2 a 10 dolarů za milion vstupních a výstupních tokenů, dřív 4 a 20
- GPT-6 Luna: 0,10 a 0,50 dolaru, dřív 0,20 a 1,20
OpenAI zdůrazňuje, že jde o trvalé ceny, ne zaváděcí akci. Pro srovnání, Opus 5.5 stojí 4 a 20, takže Sol je přesně na polovině a Luna je proti němu zhruba čtyřicetkrát levnější.
Technicky mají obě varianty stejné parametry jako zbytek rodiny: kontextové okno 1,05 milionu tokenů, výstup až 128 tisíc, znalosti do 16. února 2026 a stejnou škálu úrovní přemýšlení. Ani jedna nedosahuje na vlajkovou Astru.
Co OpenAI ukazuje
Čísla z oznámení, všechna proti Claude Opus 5:
- AutomationBench: Sol na vysokém nastavení 33,2 procenta za 0,27 dolaru na úlohu, proti Opusu 5 na maximu s 26,9 procenta a jedenáctinásobkem té ceny
- Agents' Last Exam: Sol na maximu 56,4 procenta, což podle OpenAI překonává nejlepší výsledek Opusu 5 při o 60 procent nižší ceně na úlohu
- OSWorld: Sol 60,5 procenta proti 60,3 u Opusu 5, zhruba o 80 procent levněji
Jako argument o poměru ceny a výkonu to drží. Jen je potřeba se podívat, s čím se to poměřuje.
Ta hvězdička
Všechny ty grafy srovnávají s Claude Opus 5. Ne s Opusem 5.5, který vyšel hodinu a půl předtím.
Na AutomationBench, což je jediný benchmark, který publikovaly obě firmy stejným způsobem, to vypadá takhle:
- GPT-6 Astra: 41,4 procenta
- Claude Opus 5.5: 40,0 procenta
- Claude Fable 5.1: 31,4 procenta
- GPT-6 Sol: 33,2 procenta
- Claude Opus 5: 26,9 procenta
Takže Sol sice porazil Opus 5 o šest bodů, ale na Opus 5.5 ztrácí skoro sedm. A férově k Anthropicu, ta čísla za něj hlásil Zapier ze své vlastní evaluace a běžel je bez fallback modelů, takže se každý zásah bezpečnostního klasifikátoru počítal jako neúspěch. V praxi by to číslo bylo spíš vyšší.
Nic z toho není podvod. Benchmarky se připravují týdny dopředu a OpenAI nemohla mít čísla modelu, který vyšel během jejich příprav. Ale když si za pět minut po oznámení budete vybírat model podle toho grafu, vyberete si podle stavu světa, který vydržel devadesát minut.
Luna a past dlouhého kontextu
Tohle je věc, která se v přehledech ztratí a přitom vás v produkci kousne.
Obě varianty mají v tabulce napsané stejné kontextové okno 1,05 milionu tokenů. Jak s ním ale reálně pracují, je úplně jiný příběh. Na testu MRCR, který hledá osm jehel v kupce sena na délce 256 až 512 tisíc tokenů:
- Sol: 91,5 procenta
- Luna: 41,3 procenta
Obě "umí milion tokenů". Jen jedna z nich v té délce skutečně najde, co hledáte. Pokud tedy plánujete strkat Luně do kontextu celou dokumentaci, protože je čtyřicetkrát levnější, tohle je to číslo, které si musíte ověřit na vlastních datech dřív, než to pustíte klientovi.
Co si z toho vzít
- Cena za inteligenci padá rychleji, než stíháte přepisovat kód. Za jeden den zlevnil Opus o dvacet procent a GPT-6 o padesát. Kdo v létě stavěl rozpočet projektu na tehdejších cenách, počítal s čísly, která dnes neplatí. Stojí za to si to jednou za čtvrt roku přepočítat, jak jsme psali u cost-per-task.
- Grafy v oznámeních čtěte vždy s datem v ruce. Ne proto, že by někdo lhal, ale proto, že v tomhle tempu je i poctivé srovnání staré dřív, než ho stihnete přečíst. Jediné, co vám dá jistotu, je vlastní evaluace na vlastních datech.
- Velikost kontextu není totéž co použitelnost kontextu. Rozdíl mezi 91 a 41 procenty na stejné délce je rozdíl mezi funkčním produktem a produktem, který občas tiše přehlédne půlku zadání. Tenhle parametr v marketingových tabulkách nenajdete.
- Levný model je nová kategorie, ne horší verze. Luna za deset centů za milion tokenů není "slabší GPT". Je to nástroj na jinou třídu úloh, podobně jako Jev od TypeSafe. Pokud pořád všechno posíláte na nejdražší model, platíte za schopnosti, které na dané úloze nevyužijete.
Za jediný den vyšly dva modely, oba levnější než jejich předchůdci, a oba tvrdí, že vedou. Nejužitečnější závěr je asi ten, že tohle už se nedá sledovat podle titulků. Vyberte si dva kandidáty, pusťte si je na vlastní úloze a rozhodněte se podle toho, co vám vyjde. Zítra to bude nejspíš zase jinak. 🌗
Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám a rádi to opravíme.
Související
Máte nápad?
Vytvořme ho spolu.
Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.
