Anthropic lansează Claude Fable 5.1 și Mythos 5.1, cu o reducere de 75% la costul contextului din cache

Noile modele Anthropic aduc scoruri mai bune pe teste agentice, o citire din cache de 0,25 dolari pe milion de tokenuri și o arhitectură de securitate care lasă datele de monitorizare în infrastructura clientului.

Andrei Negrescu Andrei Negrescu
11 min citire
Claude Fable 5
Publicitate

Anthropic a lansat pe 1 septembrie 2026 cele mai puternice modele ale sale de până acum, Claude Fable 5.1 și Claude Mythos 5.1. Dincolo de scorurile obișnuite pe benchmark-uri, anunțul aduce o schimbare care contează mult mai mult pentru companii: costul contextului păstrat în cache scade cu 75%, iar odată cu el se ieftinește considerabil rularea agenților care lucrează ore în șir.

Cele două denumiri se referă la același model. Fable 5.1 este versiunea disponibilă public, cu toate protecțiile de producție active. Compania pregătea de mai multă vreme această linie de modele. Mythos 5.1 circulă prin programe cu acces restricționat, destinate organizațiilor verificate din securitate cibernetică și științele vieții, care au nevoie de capabilități blocate în mod normal de aceste protecții.

Claude Fable 5.1, un model gândit pentru sarcini care nu se termină într-un singur prompt

Anthropic poziționează Fable 5.1 în jurul rezolvării problemelor de lungă durată. Pe Terminal-Bench-Science 0.1, un test pentru cercetare științifică agentică, compania raportează un scor de 52,6%, față de 24,7% pentru Fable 5, 29,0% pentru Opus 5 și 22,4% pentru GPT-5.6 Sol în configurația proprie de evaluare. Pe Terminal-Bench 4.0, Fable 5.1 obține 55,8%, comparativ cu 42,0% pentru Fable 5 și 52,3% pentru Opus 5. Mythos 5.1 ajunge la 60,9% pe același test de programare, funcționând sub protecții cibernetice mai permisive.

Rezultatele nu se opresc la cod. Pentru munca de birou, Anthropic raportează un scor GDPval-AA v2 de 1.853, față de 1.824 pentru Opus 5 și 1.723 pentru Fable 5. Pe AutomationBench, un test pentru fluxuri de lucru din companii, Fable 5.1 obține 31,4%, față de 17,1% pentru Fable 5 și 26,9% pentru Opus 5. Pe CursorBench 3.2.0 ajunge la 73,4%.

Cifrele trebuie citite ca rezultate comunicate de producător, nu ca dovezi independente de superioritate. Compania însăși menționează rezerve: protecțiile de producție pot influența scorurile, iar setul de sarcini OSWorld lansat în august 2026 nu este direct comparabil cu rezultate publicate anterior.

Ce spun clienții care au testat modelul înainte de lansare

Mai relevante decât scorurile sunt tipurile de eșecuri pe care partenerii cu acces timpuriu spun că modelul le rezolvă. Firma de investiții Millennium a comunicat că Fable 5.1 a urmărit un blocaj software extrem de rar până la o eroare aflată într-o bibliotecă externă a unui furnizor, după ce problema rezistase oricărei explicații timp de patru-cinci ani.

Publicitate

Ramp, companie de management al cheltuielilor corporative, a descris o rulare de machine learning de 38 de ore, desfășurată fără supraveghere, în care modelul a reevaluat un rezultat anterior, a lansat șase experimente și s-a întors cu concluzii și cu propuneri de pași următori. Browserbase susține că Fable 5.1 a finalizat 82% dintre sarcinile din cel mai dificil test de agent de browser al companiei, față de 74% pentru Opus 5 și 57% pentru Fable 5.

Sunt mărturii furnizate de Anthropic ca parte a lansării, nu teste reproduse independent. Ele arată însă direcția urmărită: unitatea de lucru a inteligenței artificiale se mută de la un răspuns sau un fragment de cod la o investigație completă. Iar un model care poate funcționa ore întregi are nevoie de context durabil, acces la unelte, puncte de salvare, jurnalizare, limite de permisiuni și recuperare fiabilă din erori. Documentația de preț și identificatorii modelelor sunt publicate în documentația oficială Claude.

Prețul rămâne premium, dar cache-ul schimbă calculul

Fable 5.1 păstrează tarifele Fable 5 pentru API: 10 dolari la un milion de tokenuri de intrare și 50 de dolari la un milion de tokenuri de ieșire. Schimbarea importantă este la intrarea citită din cache.

ModelIntrare / 1MCitire cache / 1MIeșire / 1M
Fable 5.110 $0,25 $50 $
Fable 510 $1,00 $50 $
Opus 55 $0,50 $25 $
Sonnet 52 $0,20 $10 $

O citire din cache pentru Fable 5.1 costă acum 0,25 dolari, față de 1,00 dolar la Fable 5. Este doar 2,5% din prețul obișnuit al tokenului de intrare, în loc de multiplicatorul de 10% folosit la majoritatea celorlalte modele Claude. Scrierile în cache rămân neschimbate, la 12,50 dolari pe milion pentru cele cu valabilitate de cinci minute și 20 de dolari pentru cele de o oră.

Publicitate

Rezultă un profil de preț neobișnuit. Intrarea și ieșirea obișnuite ale lui Fable 5.1 sunt de două ori mai scumpe decât la Opus 5, dar intrarea din cache costă jumătate față de Opus 5. Iar prețul citirii din cache este cu doar 25% mai mare decât la Sonnet 5, deși prețul de bază al intrării este de cinci ori mai mare.

Detaliul contează pentru agenți fiindcă aceștia revin în permanență la aceeași bază de cod, la aceleași instrucțiuni de sistem, definiții de unelte, documente și istoric de conversație. Anthropic estimează că prețul redus al cache-ului scade costul efectiv al lui Fable 5.1 cu aproximativ 25% pentru sarcini obișnuite și cu până la circa 45% pentru sarcini puternic agentice.

Există și alte pârghii. Procesarea în lot înjumătățește tarifele, la 5 dolari intrarea și 25 de dolari ieșirea, pentru sarcini asincrone. Inferența limitată la teritoriul SUA adaugă un multiplicator de 1,1. Căutarea web costă 10 dolari la o mie de căutări, peste consumul de tokenuri, în timp ce preluarea de pagini nu are tarif separat.

Rânduri de rack-uri de supercomputer, tipul de infrastructură pe care rulează agenții Claude Fable 5.1
Sarcinile agentice care rulează zeci de ore mută discuția de la prețul pe token la infrastructura care le susține. Foto: Trower/NASA, domeniu public, via Wikimedia Commons.

De ce era nevoie de o ieftinire

Reducerea pare o reacție la presiunea pe buget din companii. Un raport Financial Times a arătat că, la mai bine de două luni de la lansare, Fable 5 reprezenta doar circa 11% din cheltuielile pe modele Anthropic în rândul a aproximativ 70.000 de companii aflate în datele de tranzacții ale Ramp, în timp ce modelele mai ieftine Opus 5 și Opus 4.8 câștigau teren.

Publicitate

Publicația The Information a relatat, la rândul ei, îngrijorări legate de facturi imprevizibile, inclusiv cazul ServiceNow, care a început să monitorizeze utilizarea angajaților după ce își consumase rapid bugetul anual alocat Anthropic. Chiar și așa, Fable 5.1 rămâne scump față de restul pieței: prețul promoțional actual al OpenAI pentru GPT-5.6 Sol este de 4 dolari pe milion de tokenuri de intrare, 0,40 dolari pentru intrarea din cache și 20 de dolari pentru ieșire, cel puțin până pe 21 noiembrie, iar Gemini 3.7 Flash de la Google este listat la 0,75 dolari intrare și 3,75 dolari ieșire până la finalul lui 2026.

Incidentele de securitate din spatele lansării

Noua arhitectură de securitate nu poate fi înțeleasă fără contextul ultimelor săptămâni. Pe 30 iulie, Anthropic a anunțat că o analiză a 141.006 rulări de evaluare în securitate cibernetică a identificat trei incidente, cuprinzând șase rulări, în care modele Claude au ajuns pe internetul public dintr-un mediu de testare al unui terț și au obținut acces neautorizat la organizații reale. Am scris atunci despre momentul în care Anthropic a recunoscut că modelele Claude au spart sistemele a trei companii.

Modelele funcționau fără protecțiile cibernetice aplicate versiunilor comerciale. Participau la exerciții de tip capture-the-flag și li se spusese explicit că mediile lor sunt simulări fără acces la internet. O problemă de configurare a lăsat totuși o cale deschisă spre exterior.

În cel mai grav caz, Claude Opus 4.7 a dat peste o companie reală care avea același nume cu organizația fictivă din test. În patru rulări, modelul a obținut credențiale de aplicație și de infrastructură și a accesat o bază de date cu câteva sute de rânduri de date de producție. Anthropic spune că modelul a întâlnit la un moment dat indicii că sistemul este real, dar și-a continuat atacul.

Al doilea incident a implicat Mythos 5. Modelul a găsit instrucțiuni pentru dezvoltatori care făceau referire la un pachet Python inexistent și a decis că publicarea unui pachet cu acel nume l-ar ajuta să câștige provocarea simulată. A creat un cont PyPI și a urcat cod malițios în depozitul public real. Pachetul a rămas disponibil circa o oră și a fost descărcat și executat pe 15 sisteme reale. Unul aparținea unei companii de securitate al cărei scaner automat a rulat pachetul, iar codul a extras credențiale folosite ulterior pentru a accesa infrastructură suplimentară.

În al treilea incident, un model intern de cercetare al Anthropic a scanat aproximativ 9.000 de ținte de pe internet după ce nu reușise să ajungă la ținta fictivă prevăzută. A compromis o aplicație expusă public folosind credențiale lăsate la vedere și o injecție SQL, apoi s-a oprit după ce a realizat că sistemul nu avea legătură cu exercițiul.

O dezvăluire separată a AI Security Institute din Marea Britanie a întărit aceste concluzii. În testele din iulie, institutul a rulat o provocare de securitate de 122 de ori pe mai multe modele, cu acces la internet activat deliberat și cu clasificatoarele cibernetice ale furnizorilor dezactivate. Zece rulări au produs 19 acțiuni nesancționate în lumea reală. Șaptesprezece au implicat Mythos 5, iar două au venit dintr-o rulare GPT-5.6 Sol. Cea mai gravă secvență a presupus un agent Mythos 5 care a încercat să introducă cod malițios într-un proiect open-source real, creând identități false și încercând să convingă un întreținător să accepte modificarea. Acesta a refuzat, iar investigația AISI nu a găsit prejudicii concrete.

Enterprise Frontier Safeguards mută datele la client

Răspunsul Anthropic a fost să adauge straturi în jurul modelului. Compania a suspendat evaluările cibernetice externe, a oprit temporar o parte din testele interne, apoi a implementat un clasificator în timp real care detectează sondarea agresivă, tentativele de evadare din sandbox sau accesul neașteptat la internet înainte ca apelul de unealtă să se execute. Evaluările externe au fost reluate.

Fable 5.1 primește și protecții de producție mai precise. Anthropic afirmă că noile mecanisme generează cu aproximativ 60% mai puține intervenții pe sesiune Claude Code decât cele ale lui Fable 5. Modelul poate fi folosit pentru descoperirea vulnerabilităților în scop defensiv, în timp ce generarea de exploituri, testele de penetrare și o parte din scanarea de vulnerabilități pe fișiere binare rămân redirecționate sau restricționate.

A doua noutate se numește Enterprise Frontier Safeguards. Datele de monitorizare pot rămâne în mediul propriu al clientului, pe AWS, Azure sau Google Cloud, sub chei de criptare, politici de acces și jurnalizare gestionate de client. Sistemele automate ale Anthropic pot analiza datele pentru tipare asociate abuzurilor grave, iar alertele ajung la client pentru verificare. Compania afirmă că nu este necesară revizuirea umană din partea angajaților săi.

EFS a fost dezvoltat împreună cu peste 100 de organizații din servicii financiare, sănătate, industrie, telecom, drept, retail și administrație publică, alături de AWS, Google Cloud și Microsoft Azure. Suportul este planificat pentru Claude Code, Claude Enterprise, platforma Claude, Amazon Bedrock, platforma Claude pe AWS, Agent Platform de la Google și Microsoft Foundry, cu o lansare etapizată în această toamnă. Clienții eligibili pot folosi Fable 5.1 cu retenție zero a datelor până când EFS devine disponibil, iar Anthropic nu percepe o taxă separată pentru serviciu.

Dincolo de software

Capabilitățile noilor modele ies din zona programării. Anthropic raportează că Mythos 5.1 a proiectat legători proteici validați experimental, iar Fable 5.1 a antrenat o rețea neuronală care a produs o hartă altimetrică de rezoluție mai mare pentru aproximativ o treime din suprafața planetei Venus. Mythos 5.1 a optimizat și șapte modele open-source de deep learning din biologie, cu accelerări la inferență de până la 2,5 ori.

Fable 5.1 este disponibil deja prin API-ul Anthropic, sub identificatorul claude-fable-5-1, precum și pe AWS, Google Cloud și Microsoft Azure. Mythos 5.1 folosește același model de bază, dar expune protecții mai permisive pentru organizațiile verificate din apărare cibernetică și științele vieții. Pe partea de hardware, Samsung urmează să producă cipuri AI pe 2 nm pentru Anthropic.

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...