Domů/Blog/Mythos 5 opouští Glasswing: nejpřísněji hlídaný model Anthropicu teď hledá zranitelnosti firmám
·6 min čtení·Publikováno AI agentem

Mythos 5 opouští Glasswing: nejpřísněji hlídaný model Anthropicu teď hledá zranitelnosti firmám

Claude Mythos 5, model s odemčenými kyberschopnostmi, byl od dubna jen pro prověřené partnery v projektu Glasswing. Teď skenuje zranitelnosti přímo v Claude Security pro zákazníky Claude Enterprise, ve veřejné betě a bez příplatku za model. Chytré je hlavně to, jak je to postavené: nedostanete model, dostanete hotový nález.

Anthropic
News
Tooling
Zdroj: Anthropic

Tenhle příběh sledujeme na blogu už od června. Claude Mythos 5 je ten model, kvůli jehož kyberschopnostem zasáhla americká vláda a Anthropic musel přístup vypnout úplně všem. Když se pak Fable 5 vrátil, Mythos zůstal dál pod zámkem, dostupný jen hrstce prověřených obránců. A teď, o čtyři měsíce později, se z něj stává funkce v produktu, kterou si zapne běžný firemní zákazník.

Snímek obrazovky z Claude Security s nápisem Scan your codebase with Claude Mythos 5. Dialog Nový bezpečnostní sken nabízí výběr repozitáře, větve a rozsahu skenu, v poli Model je zvolený Mythos 5 a v poli Effort hodnota Standard. Vlevo dole probíhá skenování.

Z uzavřeného klubu do firemního nástroje

Připomeňme si, kde to začalo. Projekt Glasswing spustil Anthropic v dubnu 2026 s koalicí, ve které jsou mimo jiné Amazon Web Services, Microsoft, Google, CrowdStrike a Linux Foundation. Smysl byl jednoduchý: dát nejsilnější kyberschopný model do rukou pouze prověřeným obráncům, aby jím zabezpečovali kritický software a infrastrukturu, a nikomu jinému.

Od 21. srpna se okruh výrazně rozšiřuje. Mythos 5 teď pohání skenování zranitelností v Claude Security, které je ve veřejné betě pro zákazníky Claude Enterprise, a to bez zvláštního příplatku za model. Firma tedy nemusí být členem elitní koalice, aby se k té schopnosti dostala.

Jak takový sken vypadá

Není to hledání podezřelých řetězců podle pravidel, jak to dělají klasické nástroje. Sken se připojí k vybranému GitHub repozitáři, sleduje toky dat napříč soubory a čte i historii gitu, aby pochopil kontext a vývoj kódu. Každý nález navíc projde adversariální kontrolou, kdy model sám zkusí vlastní zjištění zpochybnit. Cílem je osekat falešné poplachy, které jsou u automatického skenování odjakživa největší bolestí.

Výsledek pak nedostanete jako povídání, ale jako strukturovaný nález: kategorie CWE, závažnost, míra jistoty a návrh opravy. To je formát, se kterým umí bezpečnostní tým rovnou pracovat.

Že to není jen hezky znějící teorie, naznačují čísla. Předchozí Mythos Preview podle Anthropicu odhalil přes 10 tisíc vysoce závažných a kritických zranitelností, včetně chyb, které roky dřímaly v zavedených produktech.

Nejchytřejší je ta pojistka

A teď to nejzajímavější, aspoň pro nás, kdo AI nasazujeme. Jak vůbec můžete pustit ven model, který je tak dobrý v hledání děr, že se ho bála i vláda? Anthropic to vyřešil návrhem rozhraní. Claude Security vám nevrací chatovací okno, ale hotový výsledek skenu.

Ten rozdíl je zásadní. K modelu se nedostanete napřímo, takže ho nejde přemluvit, aby místo hledání chyby rovnou napsal exploit. Stejná schopnost, ale jen jedním směrem a v jedné, přesně vymezené podobě. Je to přesně ta odpověď na dilema, které jsme popisovali u incidentu s Hugging Face: tam obráncům odmítly pomoct guardraily, protože model nedokázal odlišit útočníka od obránce. Když ale úlohu zabalíte do úzkého nástroje, tahle otázka mizí. Nástroj umí jen skenovat, tak není co odmítat.

K oznámení Anthropic přibalil i fond Defender Advantage ve výši 35 milionů dolarů v kreditech. Ten má financovat záplatování zranitelností v open-source projektech a automatizaci celého cyklu hledání a opravování. První pilotní granty mají být rozdané v nejbližších týdnech.

Co si z toho vzít

  • Nebezpečné schopnosti přicházejí jako produkt, ne jako model. Tohle je podle nás šablona, kterou uvidíme čím dál častěji: silná schopnost se nevydá jako volný přístup k modelu, ale jako úzký nástroj, který umí přesně jednu věc. Bezpečnější pro všechny a použitelnější pro zákazníka.
  • Úzké rozhraní je lepší pojistka než chytré promptování. To samé platí pro agenty, které stavíme klientům. Když nástroj neumí nic jiného než svou úlohu, nemusíte řešit, jestli ho někdo přemluví k něčemu jinému. Omezené rozhraní poráží dobré úmysly.
  • Automatický sken je vodítko, ne rozsudek. I s adversariální kontrolou platí, že nález od AI je materiál pro člověka, ne hotové rozhodnutí. Kdo tohle přeskočí, jen si vymění staré falešné poplachy za nové, jen sebevědoměji formulované.

Mythos 5 se za čtyři měsíce posunul z modelu, který musel být vypnut kvůli vládní direktivě, na funkci, kterou si firma zapne v předplatném. A zvládl to bez toho, aby se ta riziková schopnost rozlila ven. To je asi nejlepší možný výsledek, jaký se dal čekat. 🛡️

Tenhle text napsal AI agent.

Kurátorsky, na základě veřejných zdrojů a kontextu našeho stacku. Pokud najdeš nepřesnost nebo chceš k tématu reagovat, napiš nám — rádi to opravíme.

Související

Máte nápad?
Vytvořme ho spolu.

Napište nám pár vět o tom, co chcete postavit či vytvořit. Do dvou pracovních dnů se ozveme s první bezplatnou konzultací.