PangunaLBank News Center
Claude Opus 5 Nadaig ang Fable 5 sa Karamihan ng mga Pamantayan—Sa Kalahati ng Presyo
claude-opus-5-outscores-fable-5-most-benchmarks-half-price
Claude Opus 5 Nadaig ang Fable 5 sa Karamihan ng mga Pamantayan—Sa Kalahati ng Presyo
Ang bagong pang-araw-araw na modelo ng Anthropic ay mas mababa ang presyo kumpara sa sarili nitong pinaka-advanced na produkto at nalalamangan ito sa halos lahat ng mahahalagang aspeto.
2026-07-24 Pinagmulan:decrypt.co

Sa madaling sabi

  • Ang Claude Opus 5, na inilabas noong Hulyo 24, ay nagkakahalaga ng $5 bawat milyong input token—katulad ng sinundan nitong Opus 4.8 at eksaktong kalahati ng presyo ng Fable 5—habang nalalamangan ang Fable 5 sa karamihan ng mga pangunahing benchmark.
  • Nakuha ng Opus 5 ang 43.3% sa Frontier-Bench v0.1, isang agentic coding evaluation, kumpara sa 33.7% para sa Fable 5 at 34.4% para sa GPT-5.6 Sol ng OpenAI; sa ARC-AGI-3, isang bagong benchmark sa paglutas ng problema, nakakuha ito ng 30.2% laban sa 7.8% ng GPT-5.6 Sol—isang agwat na hindi malapit.
  • Ang bagong modelo ay ang default sa Claude Max at ang pinakamalakas sa Claude Pro, epektibong pumalit sa Fable 5 bilang go-to para sa karamihan ng mga subscriber.

Lumabas na ngayon ang Claude Opus 5. Mas mura ito para sa mga negosyo kaysa sa nangungunang modelo ng Anthropic, ang Claude Fable 5, na ipinosisyon ng kumpanya bilang pang-araw-araw na produkto para sa mga nagbabayad na user. Higit pa rito, nalalamangan din ito ng Opus 5 sa mahahalagang benchmark.

Upang maunawaan kung saan akma ang Opus 5: Apat na antas ang lineup ng Anthropic. Mabilis at mura ang Haiku. Mid-range ang Sonnet. Ang Opus ang mabigat na workhorse. Sa itaas nito ay ang Mythos class—isang antas na ipinakilala ng Anthropic ngayong tagsibol—na kinabibilangan ng Claude Fable 5 para sa publiko, at Claude Mythos 5, isang bersyon na may mas kaunting restriksyon na inilaan sa pamamagitan ng Project Glasswing para sa mga na-vet na cybersecurity researcher at operator ng kritikal na imprastraktura.

Nagkaroon ng magulong takbo ang Fable 5 bilang punong barko ng subscriber. Inilunsad ito noong Hunyo 9, binawi sa buong mundo tatlong araw pagkatapos maglabas ang gobyerno ng U.S. ng emergency export control order na nagbanggit ng vulnerability sa jailbreak, at bumalik noong Hunyo 30—para lamang agad lumipat sa isang credits-only model, hindi na kasama sa mga standard plan. Pinuputol na ngayon ng Opus 5 ang puwang na hindi nahawakan ng Fable 5.

Ang Lovable, isang developer platform na may milyun-milyong user, ay pinatakbo ang Opus 5 sa mga internal na pagsusuri nito at napansin na ang mga pakinabang ay lumalampas sa mga raw score: "Hindi lang ito mas mahusay sa aming pinakamahirap na agentic coding task, tumaas ng 22% kumpara sa Opus 4.7, mas matatag din ito, na may mas kaunting pagkakaiba sa bawat pagtakbo," sabi ni Fabian Hedin sa isang pahayag na ibinahagi ng Anthropic.

Ang mga benchmark

Maaaring kakaiba pakinggan, ngunit tinalo ng Opus ang Fable sa halos lahat ng mahalaga sa pang-araw-araw na user habang hindi ito nabibilang sa Mythos-class tulad ng Fable.

Sa Frontier-Bench v0.1—isang benchmark na sumusubok kung makukumpleto ng mga AI coding agent ang mga tunay na software engineering task mula simula hanggang matapos, na minarkahan bilang porsyento ng mga task na naipasa—umabot ang Opus 5 sa 43.3%. Ang Fable 5 ay umabot sa 33.7%. Ang GPT-5.6 Sol ng OpenAI, ang pangunahing komersyal na kalaban ng Anthropic, ay nakakuha ng 34.4%.

Ang pinakamalaking agwat ay sa ARC-AGI-3, isang pagsubok ng tunay na paglutas ng problema na binuo sa paligid ng mga bagong puzzle na hindi maaaring naisaulo ng isang modelo mula sa data ng pagsasanay, na minarkahan bilang porsyento ng mga puzzle na nalutas. Umabot ang Opus 5 sa 30.2%; ang GPT-5.6 Sol ay nakakuha ng 7.8%; at ang Fable 5 ay hindi nasubukan. Sa GDPval-AA v2—isang knowledge work benchmark na minarkahan sa pamamagitan ng Elo ratings, ang sistema ng pagraranggo na parang chess na ginagamit upang sukatin ang relatibong performance sa mga tunay na propesyonal na task—umabot ang Opus 5 sa 1,861 laban sa 1,747 ng Fable 5 at 1,736 ng GPT-5.6 Sol.

Sinubukan ng Zapier ang Opus 5 sa AutomationBench, isang evaluation na sumusuri kung kayang isagawa ng isang modelo ang isang buong workflow ng negosyo mula simula hanggang matapos nang walang tulong ng tao. Ang kanilang hatol: ang modelo "ay kinuha ang isang raw account-health workbook at nagpatakbo ng isang buong churn-prevention sequence mula simula hanggang katapusan: pagmarka sa mga at-risk na account, pag-alerto sa tamang may-ari, at pagbubuod para sa retention ops. Hindi pumasa ang mga nakaraang modelo; umabot ang Opus 5 sa 100%."

Ipiniprisinta rin ng Anthropic ang Opus 5 bilang isang research upgrade. Sinabi ng Ultima Genomics, isang kumpanya ng DNA sequencing, na ang modelo "ay kumikilos na parang isang maingat na siyentipiko kaysa sa anumang modelo na aming pinatakbo. Humahanap ito ng mga tamang statistical test upang alisin ang mga confounder, muling sinusuri ang sarili nitong resulta sa pamamagitan ng mga independiyenteng pamamaraan, at nananatili sa landas sa mahabang multi-step na pagsusuri."

Gayunpaman, ang dalawang lugar na ito—legal at kalusugan—lamang ang mga lugar kung saan nalalamangan ng Fable 5 nang bahagya.

Ang paglabas ay dumating isang linggo pagkatapos ibunyag ng Moonshot AI, isang Beijing-based startup na sinusuportahan ng Alibaba, ang Kimi K3—isang 2.8-trillion-parameter open-weight model (nangangahulugang maaaring i-download ng sinuman ang pinagbabatayang code upang patakbuhin ito nang independiyente) na inilarawan ng Moonshot bilang pinakamalaking open AI system sa mundo. Patuloy na inilalagay ng mga independiyenteng benchmark ang Kimi K3 sa ikatlong pangkalahatang puwesto, sa likod ng Fable 5 at GPT-5.6 Sol, na tinalo ang dalawang ito sa mga partikular na lugar.

Available na ngayon ang Opus 5 sa pamamagitan ng API sa $5 bawat milyong input token at $25 bawat milyong output. (Ang mga token ay ang pangunahing yunit ng impormasyon na kayang iproseso ng isang AI model sa input at output). Mayroon ding Fast mode na tumatakbo sa humigit-kumulang 2.5 beses ang default na bilis, sa doble ng base price—$10 bawat milyong input token at $50 bawat milyong output.

Maaaring tapusin ng paglabas na ito ang pag-aalala sa kawalan ng pampublikong availability ng Fable 5. Available din ang Opus sa pamamagitan ng subscription para sa lahat.