AcasăCentrul de știri LBank
Anthropic lansează Claude Fable 5.1, mai mult decât dublându-și predecesorul pe un benchmark cheie
anthropic-claude-fable-5-1
Anthropic lansează Claude Fable 5.1, mai mult decât dublându-și predecesorul pe un benchmark cheie
Fable 5.1 și sora sa restricționată Mythos 5.1 sosesc la trei luni după ce controalele la export au obligat Anthropic să retragă Fable 5 offline timp de 18 zile
2026-09-01 Sursă:decrypt.co

Pe scurt

  • Anthropic a lansat Claude Fable 5.1 și Claude Mythos 5.1 pe 1 septembrie, obținând 52,6% la Terminal-Bench-Science 0.1 față de 24,7% pentru Fable 5, și 55,8% la Terminal-Bench 4.0 față de 42,0%.
  • Citirile din cache costă acum cu 75% mai puțin, reducând costurile tipice ale sarcinilor de lucru cu aproximativ 25% și pe cele ale sarcinilor de lucru cu grad ridicat de autonomie cu până la 45%, prețul de bază rămânând neschimbat la 10$/50$ per milion de tokenuri.
  • Fable 5.1 nu este inclus în planurile Pro sau în locurile standard de Echipă, care îl rulează pe credite de utilizare; locurile Max și cele premium de Echipă sau Enterprise îl au inclus pentru până la 50% din limitele săptămânale.

Anthropic a lansat marți Claude Fable 5.1 și Claude Mythos 5.1, prima actualizare a liniei de modele din clasa Mythos de la lansarea Fable 5 pe 9 iunie.

Compania susține că noile modele AI sunt „cele mai avansate din lume pentru codare și muncă de cunoștințe” și vine la trei luni de la un ciclu de lansare care a inclus deja o oprire de 18 zile din cauza controlului exporturilor, o dispută de prețuri la mijlocul verii privind accesul prin abonament și o lansare în iulie a lui Claude Opus 5, care a subminat prețul lui Fable 5.

Myriad: Când va lansa OpenAI GPT-6? Click pentru a-ți face predicția.

Fable 5.1 și Mythos 5.1 sunt, conform Anthropic, același model subiacent cu filtre de siguranță diferite adăugate. Fable 5.1 este disponibil general oricui are un cont Claude. Mythos 5.1 rămâne restricționat profesioniștilor verificați din domeniul securității cibernetice și științelor vieții prin Programul de Verificare Cibernetică și Programul de Verificare în Științele Vieții al Anthropic, succesorul programului de acces Project Glasswing care a restricționat Mythos 5.

Ce măsoară de fapt benchmark-urile

Cifra principală a Anthropic provine de la Terminal-Bench-Science 0.1, un benchmark care testează dacă un agent AI poate îndeplini sarcini de cercetare științifică într-un mediu de linie de comandă, scorat ca rată de promovare.

Fable 5.1 a atins 52,6% față de 24,7% pentru Fable 5 și 29,0% pentru Opus 5, mai mult decât dublul predecesorului său.

Terminal-Bench 4.0 testează codarea agentică realizată printr-un terminal—scrierea, rularea și depanarea codului în sesiuni de linie de comandă cu mai mulți pași, scorată ca procent de sarcini finalizate corect. Fable 5.1 a obținut 55,8%, în creștere de la 42,0% pentru Fable 5 și depășind 52,3% pentru Opus 5.

Mythos 5.1, rulând cu filtre de securitate cibernetică mai ușoare, a obținut 60,9% la același test; Anthropic spune că diferența reflectă sarcini pe care măsurile sale de siguranță le-au interceptat și redirecționat către Opus 4.8.

La „Examenul Final al Umanității”, un test de raționament multidisciplinar construit din întrebări de nivel expert din zeci de domenii academice și scorat ca rată de promovare, Fable 5.1 a atins 60,9% fără instrumente externe și 65,0% cu acestea, ambele depășind Opus 5, demonstrând că acesta este cel mai avansat model al Anthropic pentru scopuri academice.

Unde depășește Opus 5 și unde matematica devine mai neclară

Opus 5 a fost lansat în iulie, costând jumătate din prețul pe token al Fable 5, depășind în același timp Fable 5 la majoritatea benchmark-urilor majore, făcând efectiv modelul emblematic redundant pentru majoritatea utilizatorilor plătitori.

Fable 5.1 inversează această situație: acum depășește Opus 5 la fiecare benchmark publicat de Anthropic, inclusiv la cele unde Opus 5 depășise anterior Fable 5.

Dar Fable 5.1 costă în continuare de două ori mai mult pe token decât Opus 5—10$ intrare și 50$ ieșire față de 5$ și 25$ pentru Opus 5. Token-urile reprezintă cantitatea de bază de informație pe care un model o poate gestiona (de obicei aproximativ două treimi dintr-un cuvânt englezesc mediu), iar companiile plătesc pentru utilizare deoarece fluxurile de lucru intense epuizează de obicei foarte rapid cotele stabilite în planurile de abonament.

Propria prezentare a modelului de către Anthropic se bazează pe nivelurile de efort, mai degrabă decât pe scorurile brute: se spune că rularea Fable 5.1 la un efort de raționament scăzut sau mediu se potrivește sau depășește vechile rezultate ale Fable 5 la un cost mult mai mic, în timp ce nivelurile superioare de efort sunt rezervate pentru problemele care pun în dificultate orice altceva.

Pentru munca de rutină, argumentul pentru a sări complet peste Opus 5 devine mai slab cu cât nivelul de efort este mai mic.

Accesul urmează aceeași împărțire care s-a aplicat Fable 5 după luni de ajustare a termenilor de către Anthropic. În planurile Pro și în locurile standard de Echipă sau Enterprise, Fable 5.1 se bazează în întregime pe creditele de utilizare plătite pe măsură, facturate la rata API, deoarece nu face parte din limitele săptămânale ale acestor planuri. În planurile Max și în locurile premium de Echipă sau Enterprise, este inclus ca parte standard a abonamentului pentru până la 50% din utilizarea săptămânală.

Claude Fable 5.1 este disponibil acum pe Claude API, Amazon Bedrock, Google Cloud și Microsoft Foundry, sub ID-ul de model „claude-fable-5-1”.