Anthropic predstavil Claude Fable 5.1: lacnejší a menej prísny

Anthropic v utorok 1. septembra uviedol dva nové modely, Claude Fable 5.1 a Claude Mythos 5.1. Firma nimi reaguje na tri najčastejšie výhrady zákazníkov k predchádzajúcej generácii: vysokú cenu, ukladanie dát a príliš citlivé bezpečnostné filtre. Fable 5.1 je dostupný okamžite pre všetkých, Mythos 5.1 zostáva vyhradený pre overených partnerov.

Dva modely, jeden základ

Oba modely majú spoločný základ a líšia sa len bezpečnostnými obmedzeniami. Fable 5.1 je verzia pre bežný trh, dostupná cez API pod označením claude-fable-5-1 a na cloudoch AWS, Google Cloud a Microsoft Azure. Mythos 5.1 je určený len organizáciám v USA zapojeným do dvoch overovacích programov, jedného pre obrannú kybernetickú bezpečnosť a druhého pre vedy o živote, ktorý vznikol v spolupráci s americkou vládou. Anthropic sľubuje, že prístup časom rozšíri aj na zahraničných partnerov.

Podľa TechCrunchu nové modely prekonali rekordy vo viacerých testoch, napríklad v Terminal-Bench 4.0 pre programovanie v príkazovom riadku a v teste Humanity’s Last Exam pre všeobecné uvažovanie. The Decoder uvádza konkrétne čísla: v Terminal-Bench 4.0 dosiahol Fable 5.1 skóre 55,8 percenta a Mythos 5.1 60,9 percenta, kým predchádzajúci Fable 5 mal 42,0 percenta. V teste Terminal-Bench-Science 0.1 získal nový model 52,6 percenta oproti 24,7 percenta u predchodcu.

Cena klesla, ale nie pre každého

Najväčšou výhradou k modelu Fable 5 bola cena a Anthropic ju teraz rieši nepriamo. Sadzby za vstupné a výstupné tokeny zostávajú rovnaké, 10 dolárov za milión vstupných a 50 dolárov za milión výstupných tokenov. Zlacnelo však čítanie z vyrovnávacej pamäte, z jedného dolára na 0,25 dolára za milión tokenov. Pri bežnom použití to podľa firmy znamená úsporu okolo 25 percent, pri dlhých agentických úlohách s množstvom volaní nástrojov až 45 percent.

Spoločnosť Artificial Analysis, ktorá sa podieľala na testovaní pred vydaním, však úsporu spochybňuje. Pri najvyššej úrovni úsilia spotrebuje Fable 5.1 zhruba 1,7-krát viac výstupných tokenov ako Fable 5, takže jedna úloha vyjde približne o 20 percent drahšie. Na porovnanie, model Opus 5 stojí polovicu, 5 dolárov za vstup a 25 dolárov za výstup, a v testoch zaostáva len o pár bodov. Skutočná úspora teda závisí od toho, ako si firma model nastaví.

Menej falošných poplachov

Druhou zmenou sú miernejšie bezpečnostné filtre. V generácii 5.0 boli podľa The Decoderu také citlivé, že blokovali aj nevinné otázky. Filtre pre kybernetickú bezpečnosť teraz hlásia o 60 percent menej falošných poplachov a pri otázkach zo základov biológie a medicíny zasahujú o 85 percent menej často. Fable 5.1 môže po prvý raz vyhľadávať zraniteľnosti v softvéri, no tvorbu exploitov a penetračné testy Anthropic naďalej presmerúva na modely radu Opus. Mythos 5.1 si pritom ponecháva rovnaké obmedzenia pre biológiu ako jeho predchodca.

Zmenil sa aj štýl písania. Výskumník Anthropicu Felix Rieseberg uviedol, že model menej používa odrážky a tučné písmo a lepšie sa drží zadaného štýlu. Nové modely sú tiež prvé od firmy, ktoré majú v texte zabudovaný vodoznak. Anthropic zároveň v súkromnom náhľade spustil rozhranie, cez ktoré si regulátori, médiá a overovatelia faktov môžu overiť, či text vznikol v Claude.

Dáta zostanú u zákazníka

Tretia výhrada sa týkala ukladania dát. Anthropic na jeseň spustí službu Enterprise Frontier Safeguards, ktorá uchováva údaje výlučne v cloude zákazníka. Dohľad nad zneužitím zostáva, no firma sama rozhodne, ako bude prebiehať. Anthropic tiež zopakoval, že na firemných dátach nikdy netrénoval bez výslovného súhlasu. Nové účty v API už nemôžu upravovať predchádzajúci kontext konverzácie pri zachovaní prepisu uvažovania, čím firma zatvára jednu z techník takzvanej destilácie, teda systematického kopírovania schopností modelu cez tisíce falošných účtov.

Čo to znamená pre firmy

Pre slovenské a české firmy, ktoré Claude používajú cez API alebo cez cloud, je hlavnou správou zmena ekonomiky agentických úloh. Už v prehľade o tom, kto vedie vo vývoji AI agentov, sme písali, že práve dlhé automatizované procesy sú najdrahšie. Úspora príde len tam, kde model opakovane číta rovnaký kontext. Kto model používa na krátke odpovede, ušetrí málo, a pri najvyššom úsilí môže dokonca zaplatiť viac. Oplatí sa preto vyskúšať úroveň úsilia, pri nízkej a strednej má Fable 5.1 podľa Anthropicu dosahovať výsledky Fable 5 za nižšiu cenu.

Miernejšie filtre pomôžu najmä firmám v zdravotníctve, farmácii a bezpečnosti, kde predchádzajúca verzia blokovala bežné otázky. Pri výbere modelu však nerozhoduje len cena za token, ale aj to, koľko práce model naozaj urobí za jednu úlohu. Peter Kudlej na svojom blogu opisuje, ako pri rozhodovaní o AI nástrojoch vo vlastnej firme porovnáva náklady s výsledkom, a nie s cenníkom. Služba na uchovanie dát u zákazníka odstráni jednu z hlavných prekážok pre regulované odvetvia, no príde až na jeseň a cena zatiaľ nie je známa. Dovtedy platí rada z nášho staršieho článku o tom, ako sledovať, čo AI agenti vo firme naozaj robia.

Zdroje

Najnovšie články

spot_imgspot_img

Naposledy pridané články

1 Comment

Leave a reply

Please enter your comment!
Please enter your name here

spot_imgspot_img