Anthropic vydal Fable 5.1 a Mythos 5.1. Modely mají být levnější
Anthropic uvedl nové verze modelů Fable a Mythos 5.1, které podle společnosti přinášejí vyšší výkon, nižší náklady na tokeny a méně falešně pozitivních zásahů bezpečnostních pravidel. Fable 5.1 je dostupný veřejně, zatímco Mythos 5.1 zůstává určený registrovaným partnerům z oblasti kyberbezpečnosti a biověd.
Dvě verze jednoho modelu
Anthropic v úterý představil Fable 5.1 a Mythos 5.1 jako dvojici nových verzí svého nejpokročilejšího modelu. Kromě zlepšení výkonu se firma zaměřila také na snížení nákladů spojených se zpracováním tokenů a na omezení situací, kdy bezpečnostní mechanismy chybně vyhodnotí běžný požadavek jako problematický.
Mythos 5.1 navazuje na předchozí model Mythos a Anthropic ho zpřístupní pouze registrovaným partnerům, kteří se věnují výzkumu v kyberbezpečnosti nebo biovědách. Fable 5.1 je naopak popisován jako neomezená varianta. Od 1. září 2026 je dostupný prostřednictvím cloudových platforem nebo API společnosti Anthropic.
Větší kontrola nad daty
Jednou z nejvýraznějších změn je rozšíření režimu zero data retention. Zákazníci tak mohou modely Anthropic provozovat na vlastní infrastruktuře bez odtoku dat mimo své prostředí. U Fable tato možnost dříve nebyla k dispozici kvůli bezpečnostním obavám.
Služba s vysokou úrovní ochrany soukromí nazvaná Enterprise Frontier Safeguards se má uživatelům začít nasazovat na podzim. Anthropic uvádí, že systém bude i nadále sledovat možné zneužití modelu agenty nebo lidmi, zákazníci ale získají kontrolu nad tím, jak bude toto monitorování probíhat. Firma zároveň zdůraznila: „Anthropic has never trained on enterprise data without explicit permission, and never will.“
Výsledky testů i vědecké objevy
Nové modely podle Anthropic vytvořily rekordy v několika testech. Patří mezi ně Terminal-Bench 4.0, který se zaměřuje na programování v příkazovém řádku, a Humanity’s Last Exam určený k hodnocení obecného uvažování.
Ještě před zveřejněním modelů Anthropic představil také tři nové vědecké výsledky vytvořené s jejich pomocí. Patří mezi ně vlastní optimalizace GPU a mapa Venuše ve vysokém rozlišení sestavená z již existujících fotografií. Podkladový materiál ale neuvádí další podrobnosti o těchto výstupech.
Bezpečnostní hodnocení
Součástí vydání je podrobný system card, který popisuje schopnosti a rizika modelů. Mythos je v něm v oblasti automatizovaného vývoje umělé inteligence, tedy schopnosti AI zlepšovat samu sebe, hodnocen jako „low-risk“. Dokument uvádí, že jeho schopnost urychlit interní výzkum a vývoj AI odpovídá současným trendům.
V oblasti obecně nežádoucího chování je Mythos podle hodnocení o něco problematičtější než Opus. System card ho označuje za „a slight regression on overall misaligned behavior compared to Opus 5, and an improvement over Mythos 5 and Claude Sonnet 5“. Model ochotněji spolupracuje při zneužití člověkem a snáze přijímá neověřitelné tvrzení o oprávnění k činnosti. Zároveň méně často ignoruje výslovná omezení, vymýšlí si vstupy nebo nepravdivě tvrdí, že dokončil zadaný úkol.