Anthropic uvádza Claude Fable 5.1 a kontrolovane sprístupňuje výkonnejší Mythos 5.1
Claude Fable 5.1 cieli na dlhé agentické úlohy, lacnejšie čítanie cache a menej falošných bezpečnostných zásahov. Variant Mythos 5.1 zostáva dostupný iba pre preverované organizácie.
Za text zodpovedá Redakcia AI Feed. Zodpovedný editor: Marek Považský. Ako používame AI.
- Typ zdroja
- Oficiálny zdroj
- Zdroj / autorita
- Anthropic
Ako vznikol tento text
Redakcia spracovala verejné podklady do slovenského kontextu. Za výber, pravidlá kvality a prípadné opravy zodpovedá Marek Považský.
Text je zaradený v sekcii AI modely a opiera sa o 5 zdrojov. Konkrétne odkazy sú uvedené pod článkom; podrobnosti o AI postupe vysvetľuje metodika redakcie.
Anthropic uviedol modely Claude Fable 5.1 a Claude Mythos 5.1, ktoré podľa firmy zdieľajú rovnaký základný model, ale líšia sa úrovňou bezpečnostných obmedzení a spôsobom prístupu. Fable 5.1 je všeobecne dostupný cez produkty Claude, vývojársku platformu a partnerské cloudy. Mythos 5.1 je určený iba pre preverované organizácie zapojené do programov pre kybernetickú obranu a biologický výskum. Ide tak nielen o aktualizáciu výkonu, ale aj o experiment s rozdelenou distribúciou toho istého modelu podľa rizika použitia.
Fable 5.1 je zameraný na náročné programovanie, znalostnú prácu, výskum a dlhé agentické behy. Anthropic tvrdí, že model menej často volí povrchné skratky, lepšie hľadá koreňovú príčinu problémov a dokáže pracovať celé hodiny naprieč nástrojmi. Oficiálna dokumentácia uvádza kontextové okno s jedným miliónom tokenov, maximálny výstup 128-tisíc tokenov, trvalo zapnuté adaptívne uvažovanie a predvolenú vysokú úroveň úsilia. Spoľahlivý znalostný limit firma datuje na jún 2026.
Jeden model, dve bezpečnostné vrstvy
Najneobvyklejšou časťou vydania je vzťah medzi Fable a Mythos. Anthropic ich opisuje ako rovnaký model s odlišnými ochrannými mechanizmami. Všeobecne dostupný Fable obmedzuje alebo presmerúva časť požiadaviek v kybernetike a biológii na menej schopné modely. Mythos zachováva širšie schopnosti v rizikových oblastiach, ale prístup k nemu získajú iba preverené subjekty. V kybernetike má ísť o organizácie zamerané na obranu; pri biológii firma pripravila kontrolovaný program v spolupráci s vládou USA.
Pri väčšine aplikácií majú požiadavky označené kybernetickými filtrami smerovať na Claude Opus 4.8 a biologické požiadavky na Opus 5. Vývojári používajúci API musia fallback nakonfigurovať. Anthropic zároveň uvádza, že zákazník nemá za presmerovanú požiadavku platiť cenu Fable. Toto riešenie môže znížiť riziko zneužitia, ale pre produkčné systémy vytvára novú premennú: rovnaký vstup nemusí vždy obslúžiť rovnaký model, čo môže meniť kvalitu, latenciu aj reprodukovateľnosť odpovede.
Firma tvrdí, že nové kybernetické ochrany blokujú o 60 percent menej neškodných požiadaviek než predchádzajúca verzia. Fable 5.1 má po novom pomáhať pri objavovaní softvérových zraniteľností, nie však pri tvorbe exploitov. Ide o údaj výrobcu, nie výsledok nezávislého auditu. Presná hranica medzi legitímnym výskumom zraniteľnosti a praktickou prípravou útoku býva navyše kontextová. Vývojári bezpečnostných nástrojov preto budú musieť overiť nielen mieru odmietnutí, ale aj to, či presmerovanie neodstráni podstatné technické schopnosti potrebné na ich prácu.
Výkon sa má posunúť najmä pri dlhých úlohách
Anthropic prezentuje výrazné zlepšenia v agentickom programovaní, vedeckom výskume a znalostnej práci. Vo firemnom meraní dosiahol Fable 5.1 na Terminal-Bench-Science 0.1 skóre 52,6 percenta, kým Fable 5 dosiahol 24,7 percenta. Na Terminal-Bench 4.0 firma uvádza 55,8 percenta pre Fable 5.1 a 60,9 percenta pre Mythos 5.1. Rozdiel medzi variantmi má podľa Anthropicu odrážať najmä zásahy skorších, menej presných kybernetických filtrov.
V ďalších publikovaných výsledkoch dosiahol Fable 5.1 hodnotu 73,4 percenta na CursorBench 3.2.0, 65 percent na Humanity’s Last Exam s nástrojmi a 31,4 percenta na AutomationBench. Tieto čísla nemožno čítať ako univerzálne poradie modelov. Benchmarky používajú konkrétny agentický harness, úroveň výpočtového úsilia a cenový rozpočet; pri Terminal-Bench-Science firma uvádza štandardnú chybu približne 3,5 až 4,5 percentuálneho bodu. Anthropic tiež upozorňuje, že pri niektorých bezpečnostných zásahoch sa úloha započítala ako nula alebo ju dokončil náhradný model.
Práve výkon vzhľadom na cenu môže byť pre prevádzku dôležitejší než maximálne skóre. Model podporuje viac úrovní úsilia a podľa výrobcu môže pri nízkom alebo strednom nastavení dosiahnuť podobný či lepší výsledok než Fable 5 za nižšiu cenu. To umožňuje nasadiť nákladnejšie uvažovanie iba na úlohy, ktoré ho potrebujú. Reálne úspory však budú závisieť od dĺžky kontextu, miery opakovania promptov, počtu krokov agenta a od toho, či model úspešne dokončí úlohu bez drahého opakovania.
Lacnejšia cache mení ekonomiku agentov
Základná cena zostáva 10 dolárov za milión vstupných a 50 dolárov za milión výstupných tokenov. Výrazne sa však znižuje cena čítania promptovej cache na 0,25 dolára za milión tokenov, čo je o 75 percent menej než pri Fable 5. Anthropic odhaduje približne 25-percentnú úsporu pri typickej záťaži a až približne 45 percent pri silno agentických pracovných postupoch. AWS súčasne potvrdilo dostupnosť Fable 5.1 v službe Amazon Bedrock a na platforme Claude v prostredí AWS.
Lacnejšie čítanie cache je praktické najmä pri agentoch, ktorí v každom kroku opakovane spracúvajú rovnaké systémové pravidlá, dokumentáciu, zdrojový kód alebo históriu úlohy. Neznižuje však cenu nového vstupu ani výstupu. Tím, ktorý nevie stabilne využívať cache alebo necháva agenta generovať dlhé pracovné záznamy, nemusí deklarovanú úsporu dosiahnuť. Pred migráciou preto dáva zmysel merať cenu za úspešne dokončenú úlohu, nie iba cenu tokenu alebo výsledok jedného benchmarku.
Pre slovenské firmy môže byť zaujímavá dostupnosť cez viac cloudov a deklarovaná podpora dlhých dokumentov. Pri právnych, finančných alebo technických materiáloch však miliónové kontextové okno samo osebe nezaručuje, že model nájde správnu informáciu a použije ju bez skreslenia. Potrebné sú lokálne evaluácie v slovenčine, testy citácií, oprávnení a izolácie dát. Osobitne pri autonómnych agentoch treba nastaviť rozpočty, limity nástrojov, schvaľovanie citlivých operácií a záznam krokov, ktoré umožnia výsledok spätne skontrolovať.
Súkromie sa presúva do infraštruktúry zákazníka
Anthropic oznámil Enterprise Frontier Safeguards, systém, pri ktorom majú byť monitorované dáta uložené v cloudovej infraštruktúre kontrolovanej zákazníkom, nie u Anthropicu. Firma ho prirovnáva k režimu nulovej retencie dát a plánuje ho zavádzať po etapách od jesene. Do jeho dostupnosti môžu oprávnení zákazníci používať Fable 5.1 s nulovou retenciou. Štandardne však používanie Fable vyžaduje 30-dňové uchovanie dát na bezpečnostný monitoring.
Model rozdelený na verejný Fable a kontrolovaný Mythos ukazuje, ako laboratóriá hľadajú kompromis medzi širším nasadením a schopnosťami s potenciálom zneužitia. Zatiaľ nevieme, ako transparentne bude možné kontrolovať presmerovanie požiadaviek, aká bude dostupnosť Mythosu mimo USA ani ako sa Enterprise Frontier Safeguards osvedčia v auditoch európskych zákazníkov. Nezávislé hodnotenia ešte len musia potvrdiť výkon, mieru falošných zásahov a bezpečnostné tvrdenia výrobcu.
Fable 5.1 preto nie je iba „rýchlejší a lepší“ model. Dôležitými časťami vydania sú cena opakovaného kontextu, riadenie citlivých schopností, umiestnenie monitorovacích dát a možnosť dlhých autonómnych behov. Organizácie by mali novinku posudzovať ako celý prevádzkový balík. Silnejší agent môže priniesť vyššiu produktivitu, no zároveň potrebuje presnejšie oprávnenia, vlastné evaly a jasný plán pre situácie, keď ochranná vrstva úlohu odmietne alebo odovzdá inému modelu.
Zdroje