
Claude Opus 5 este disponibil de astăzi. Este mai ieftin pentru companii să-l ruleze decât modelul de top al Anthropic, Claude Fable 5, pe care compania îl poziționase ca produs de frontieră zilnic pentru utilizatorii plătitori. Mai mult, Opus 5 îl depășește și în benchmark-uri semnificative.
Pentru a înțelege unde se încadrează Opus 5: gama Anthropic are patru niveluri. Haiku este rapid și ieftin. Sonnet este de nivel mediu. Opus este calul de bătaie puternic. Deasupra acestora se află clasa Mythos — un nivel introdus de Anthropic în această primăvară — care include Claude Fable 5 pentru public și Claude Mythos 5, o versiune cu mai puține restricții, rezervată prin Project Glasswing cercetătorilor de securitate cibernetică verificați și operatorilor de infrastructură critică.
Fable 5 a avut o perioadă dificilă ca model emblematic pentru abonați. A fost lansat pe 9 iunie, a fost retras global trei zile mai târziu, după ce guvernul SUA a emis un ordin de control al exporturilor de urgență, invocând o vulnerabilitate de tip jailbreak, și a revenit pe 30 iunie — doar pentru a trece imediat la un model bazat exclusiv pe credite, nefiind inclus în planurile standard. Opus 5 ocupă acum locul pe care Fable 5 nu l-a putut menține.
Lovable, o platformă de dezvoltatori cu milioane de utilizatori, a rulat Opus 5 în evaluările sale interne și a remarcat că beneficiile depășesc scorurile brute: "Nu este doar mai bun la cele mai dificile sarcini de codare agentică, cu o creștere de 22% față de Opus 4.7, ci este și mai stabil, cu o variație mult mai mică de la o rulare la alta," a declarat Fabian Hedin într-o declarație împărtășită de Anthropic.
Poate părea ciudat, dar Opus depășește Fable în aproape tot ceea ce contează pentru utilizatorul obișnuit, fără a fi etichetat ca model de clasă Mythos, precum Fable.
La Frontier-Bench v0.1 — un benchmark care testează dacă agenții de codare AI pot finaliza sarcini reale de inginerie software end-to-end, punctat ca procent din sarcinile trecute — Opus 5 a atins 43,3%. Fable 5 a obținut 33,7%. GPT-5.6 Sol de la OpenAI, principalul rival comercial al Anthropic, a înregistrat 34,4%.
Cea mai mare diferență este la ARC-AGI-3, un test de rezolvare a problemelor autentice, construit în jurul unor puzzle-uri noi pe care un model nu le-ar fi putut memora din datele de antrenament, punctat ca procent de puzzle-uri rezolvate. Opus 5 a atins 30,2%; GPT-5.6 Sol a obținut 7,8%; iar Fable 5 nu a fost testat deloc. La GDPval-AA v2 — un benchmark de muncă bazată pe cunoștințe, punctat prin ratinguri Elo, sistemul de clasificare în stil șah, folosit pentru a măsura performanța relativă în sarcini profesionale reale — Opus 5 a ajuns la 1.861 față de 1.747 al Fable 5 și 1.736 al GPT-5.6 Sol.
Zapier a testat Opus 5 pe AutomationBench, o evaluare care măsoară dacă un model poate desfășura un flux de lucru complet de afaceri de la început până la sfârșit fără ajutor uman. Verdictul lor: modelul "a preluat un registru brut de sănătate a conturilor și a rulat o secvență completă de prevenire a abandonului, de la un capăt la altul: semnalarea conturilor cu risc, alertarea proprietarului corect și rezumarea pentru operațiunile de retenție. Modelele anterioare nu au reușit; Opus 5 a atins 100%."
Anthropic prezintă Opus 5 și ca un upgrade pentru cercetare. Ultima Genomics, o companie de secvențiere ADN, a declarat că modelul "se comportă mai mult ca un om de știință precaut decât orice model pe care l-am rulat. Caută testele statistice potrivite pentru a exclude factorii de confuzie, își verifică propriile rezultate prin metode independente și rămâne pe drumul cel bun prin analize lungi, în mai multe etape."
Acestea fiind spuse, aceste două domenii — juridic și sănătate — sunt singurele în care Fable 5 excelează cu o marjă minusculă.
Lansarea vine la o săptămână după ce Moonshot AI, un startup din Beijing susținut de Alibaba, a dezvăluit Kimi K3 — un model open-weight cu 2,8 trilioane de parametri (ceea ce înseamnă că oricine poate descărca codul subiacent pentru a-l rula independent) pe care Moonshot îl descrie ca fiind cel mai mare sistem AI deschis din lume. Benchmark-urile independente plasează constant Kimi K3 pe locul al treilea în clasamentul general, în spatele atât a Fable 5, cât și a GPT-5.6 Sol, depășindu-le pe acestea două în anumite domenii.
Opus 5 este acum disponibil prin API la 5 dolari per milion de tokenuri de intrare și 25 de dolari per milion de tokenuri de ieșire. (Tokenurile sunt unitatea de bază de informație pe care un model AI o poate procesa atât la intrare, cât și la ieșire). Un mod Rapid, rulând la aproximativ 2,5 ori viteza implicită, este de asemenea disponibil, la un preț dublu față de cel de bază — 10 dolari per milion de tokenuri de intrare și 50 de dolari per milion de tokenuri de ieșire.
Această lansare ar putea pune capăt anxietății legate de lipsa disponibilității publice a Fable 5. Opus este, de asemenea, disponibil prin abonament pentru toată lumea.








