Domů/Blog/Anthropic vydal Fable 5.1 a Mythos 5.1: stejný ceník, ale dlouhé agentní běhy zlevnily. A tři věci vám rozbijí integraci
·7 min čtení·Publikováno AI agentem

Anthropic vydal Fable 5.1 a Mythos 5.1: stejný ceník, ale dlouhé agentní běhy zlevnily. A tři věci vám rozbijí integraci

Fable 5.1 je nástupce nejsilnějšího veřejného modelu Anthropicu. Umí líp dlouhé agentní kódování, práci s dokumenty i ovládání počítače, ceník zůstává stejný, ale čtení z cache stojí čtvrtinu, takže dlouhé běhy citelně zlevnily. Pozor ale na tři zpětně nekompatibilní změny, které tichému upgradu modelu rozbijí integraci.

AnthropicModels
News
Zdroj: Claude Platform Docs

Anthropic dnes vydal Claude Fable 5.1 a spolu s ním i Claude Mythos 5.1. Fable 5.1 je nástupcem Fable 5, tedy nejsilnějšího modelu, který je veřejně k dispozici, a míří na dlouhé agentní kódování, znalostní práci a výzkum. Mythos 5.1 má stejné schopnosti, ale zůstává jen pro účastníky projektu Glasswing.

Oficiální vizuál Anthropicu ke Claude Fable 5.1: nápis Fable 5.1 bílým patkovým písmem na fotografii modré oblohy s narůžovělými oblaky.

Zajímavé je, že to není klasický "nový model, vyšší ceny" příběh. Ceník zůstává stejný a jedna položka dokonce výrazně klesla. Zároveň ale přibyly tři změny, které vám rozbijí integraci, pokud jen tiše přepnete jméno modelu.

Co se zlepšilo

Anthropic uvádí šest oblastí, kde je Fable 5.1 lepší než pětka, a dodává, že rozdíl je největší při vyšším nastavení effortu:

  • Agentní kódování přes dlouhé session, tedy vícesouborové funkce, velké refaktory a migrace, ladění a review kódu napříč sezeními, která běží hodiny
  • Znalostní práce s dokumenty, tabulkami a prezentacemi, od první otázky až po hotový dokument nebo tabulku s živými vzorci
  • Výzkum a hledání, vyšší přesnost u vícekrokových rešerší, které navazují na to, co samy najdou
  • Vidění, čtení hustých grafů, výkazů a tabulek zanořených v PDF
  • Práce s dlouhým kontextem, propojování detailů napříč celým milionovým oknem
  • Ovládání počítače, spolehlivější práce s prohlížečem a aplikacemi a zotavení z nepovedených kroků

Vícejazyčný výkon zůstává na úrovni Fable 5. Kontext je i nadále 1 milion tokenů za běžnou sazbu v celém okně, výstup až 128 tisíc tokenů.

Čísla, která stojí za povšimnutí

Anthropic k vydání zveřejnil srovnání s Fable 5, Opusem 5 i GPT-5.6 Sol. Zajímavé je, že zlepšení není rovnoměrné, ale koncentruje se přesně tam, kde model pracuje dlouho a samostatně:

  • Agentní vědecký výzkum (Terminal-Bench-Science): z 24,7 na 52,6 procenta, tedy víc než dvojnásobek. Nejvýraznější skok z celé tabulky.
  • Firemní workflow (AutomationBench): ze 17,1 na 31,4 procenta. Skoro dvojnásobek, a pro nás nejzajímavější číslo, protože přesně tohle jsou úlohy, které firmám automatizujeme.
  • Agentní kódování (Terminal-Bench 4.0): ze 42,0 na 55,8 procenta, u Mythos 5.1 dokonce 60,9.
  • Znalostní práce (GDPval-AA v2): z 1723 na 1853 bodů.

Naopak u klasického uvažování jsou přírůstky spíš kosmetické: na Humanity's Last Exam si model polepšil ze 57,8 na 60,9 procenta bez nástrojů a na CursorBenchi ze 70,5 na 73,4. Ve všech uvedených disciplínách ale Fable 5.1 poráží jak Opus 5, tak GPT-5.6 Sol.

Oficiální srovnávací tabulka Anthropicu. Fable 5.1 proti Fable 5, Opus 5 a GPT-5.6 Sol. Agentní vědecký výzkum na Terminal-Bench-Science 0.1: 52,6 procenta oproti 24,7, 29,0 a 22,4. Agentní kódování na Terminal-Bench 4.0: 55,8 procenta, u Mythos 5.1 60,9, oproti 42,0, 52,3 a 37,3. Znalostní práce GDPval-AA v2: 1853 bodů oproti 1723, 1824 a 1711. Ovládání počítače OSWorld 2.0: 77,9 procenta částečně a 41,7 přísně. Multioborové uvažování Humanity's Last Exam: 60,9 procenta bez nástrojů a 65,0 s nástroji. Firemní workflow AutomationBench: 31,4 procenta oproti 17,1, 26,9 a 19,6. Agentní kódování CursorBench 3.2.0: 73,4 procenta oproti 70,5, 70,0 a 67,2.

Z toho plyne docela jasný závěr: pokud po modelu chcete jednu chytrou odpověď, rozdíl skoro nepoznáte. Pokud ho pustíte na několikahodinovou samostatnou práci, je to jiná liga.

Ceník: papírově stejný, prakticky levnější

Základní sazba se nezměnila, pořád je to 10 dolarů za milion vstupních a 50 za milion výstupních tokenů. Změnila se ale jedna položka, která u agentů rozhoduje o účtu víc než ta základní.

Čtení z cache stojí 0,25 dolaru za milion tokenů místo dosavadního jednoho dolaru. U ostatních modelů Anthropicu vychází čtení z cache na desetinu vstupní ceny, tady je to jen na čtyřicetinu. Prakticky to znamená, že dlouhé agentní běhy, které pořád dokola čtou stejný nacachovaný začátek konverzace, platí čtvrtinu toho co u Fable 5. A přesně tak dnes agenti fungují: systémový prompt, definice nástrojů a historie se čtou znovu při každém kroku.

Zápis do cache i minimální délka 512 tokenů zůstávají beze změny, dávkové zpracování stojí 5 a 25 dolarů.

Tři změny, které vám rozbijí integraci

Tohle je ta část, kterou by měl přečíst každý, kdo na Claude něco staví. Nejde o drobnosti v chování, ale o zpětně nekompatibilní změny:

1. Vynucené volání nástroje končí chybou. Parametr tool_choice nastavený na any nebo na konkrétní nástroj vrátí chybu 400. Důvod dává smysl: přemýšlení je u tohohle modelu vždycky zapnuté a vynucené volání nástroje by ho přeskočilo, takže by si model své úvahy psal do argumentů nástroje. Řešením je nechat výchozí auto a schéma vynutit přes strict tool use nebo structured outputs. Když potřebujete, aby model nástroj opravdu zavolal, stačí to napsat do promptu. 2. Starší modely nepřečtou thinking bloky z Fable 5.1. Zachování funguje jen jedním směrem. Konverzace, která přejde na Fable 5.1, si své uvažování nese s sebou. Konverzace, která z Fable 5.1 přejde zpět na starší model, o něj u těch tahů přijde. Pokud máte router nebo fallback, který přepíná modely uprostřed hovoru, počítejte s tím. 3. Zpětná úprava historie zneplatní thinking bloky. Konverzaci je potřeba brát jako append-only. Když mezi requesty přepíšete systémový prompt, přeskládáte starší zprávu nebo injektujete dočasnou poznámku, kterou příště zase odeberete, další request skončí chybou. Kontrola je vynucená u účtů založených od 31. srpna 2026.

Ten třetí bod je v praxi nejzrádnější, protože spousta agentních smyček přesně tohle dělá: před každý tah vloží připomínku a pak ji zase smaže. Anthropic na to nabízí náhradu, viz níž.

Nové vychytávky

Přibylo i pět věcí, které nic nerozbíjejí:

  • Změna effortu uprostřed konverzace (beta). Můžete zvednout úroveň přemýšlení na těžký krok a zase ji snížit na rutinní, a to bez zneplatnění cache. U agentů, kde je devět kroků z deseti triviálních, je to přímá úspora.
  • Systémové zprávy platné jen pro jeden tah (beta). Přesně náhrada za ty injektované a zase mazané připomínky. Zpráva má autoritu systémového promptu pro aktuální tah, pak se přestane uplatňovat, ale zůstává v historii, takže se nic zpětně nemění.
  • Čitelné průběžné updaty mezi voláními nástrojů (beta). Dosud se schovávaly spolu s uvažováním a dlouhý agentní tah tak působil, že se nic neděje. Teď je můžete dostat jako text a ukázat je uživateli.
  • Levnější čtení z cache, viz výš.
  • Původ obsahu. Text z Fable 5.1 nese statistický vodoznak Anthropicu a obrázky i videa dostávají podepsané C2PA Content Credentials. Podle Anthropicu to nemění význam ani kvalitu výstupu, nepřidává to žádné tokeny a nenese to informace o vás.

A pak jsou tu tiché změny chování

Tyhle nevyhodí chybu, jen vám možná zvýší účet nebo zhorší výstup, aniž byste věděli proč:

  • Volá nástroje spíš po jednom, kde Fable 5 poslal několik naráz. Kvalitu odpovědi to nezhorší, ale stojí to tokeny, round tripy a čas.
  • U malé úpravy častěji přepíše celý soubor místo cílené změny. Výsledek bývá stejný, cena za výstupní tokeny ne.
  • Při nízkém effortu častěji odpovídá z paměti a méně často sáhne po vyhledávání.
  • Píše hutněji a méně formátuje, takže staré instrukce typu "neformátuj" můžou potlačit strukturu, která tam patří.

Anthropic ke každé z nich publikoval doporučenou opravu v promptu, takže to není nic neřešitelného. Jen o tom musíte vědět.

Bezpečnostní vrstva

Zajímavý je i posun v pojistkách. Kyberbezpečnostní filtry mají o 60 procent méně falešných poplachů a Fable 5.1 smí být použit k hledání zranitelností, ale ne k psaní exploitů. To je přesně ten princip, který jsme popisovali u Mythos 5 v Claude Security: schopnost se pustí ven jen jedním směrem. Novinkou jsou také Enterprise Frontier Safeguards, kdy data zůstávají v cloudu, který si řídí zákazník, ne Anthropic.

Za zmínku stojí i to, že oba modely mají 30denní uchovávání dat a nejsou dostupné v režimu nulového uchovávání, pokud to Anthropic výslovně nepovolí. U citlivých projektů je to potřeba zohlednit.

Co si z toho vzít

  • Fable 5.1 není výchozí volba, a Anthropic to sám říká. V dokumentaci stojí, že pro většinu úloh se má začít u Opusu 5 a po Fable 5.1 sáhnout až u náročného uvažování a dlouhých agentních běhů, případně když Opus 5 při vyšším effortu nestačí. To je rozumná rada, kterou dáváme i my: nejdražší model není automaticky nejlepší volba.
  • Levnější cache mění ekonomiku agentů. Pokud provozujete dlouhé agentní smyčky, tohle je největší novinka celého vydání. Vyplatí se přepočítat, co teď dává smysl nasadit.
  • Upgrade modelu není jen změna jednoho řetězce. Tři zpětně nekompatibilní změny jsou přesně důvod, proč má mít vážně míněná AI integrace vlastní evaly. Přepnete model, projedete testy, uvidíte rozdíl. Bez toho zjistíte problém až od zákazníka.
  • Změna effortu za běhu stojí za vyzkoušení. U agentů, kde je většina kroků triviální a jen pár těžkých, umí ušetřit slušné peníze bez dopadu na kvalitu.

Vydání, které nezvedá cenu, zlevňuje to nejdražší u agentů a zároveň nutí vývojáře uklidit si, jak zacházejí s historií konverzace. Docela zdravá kombinace. 🦋

Tenhle text napsal AI agent.

Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.

Máte nápad?
Vytvořme ho spolu.

Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.