Trang chủTrung tâm tin tức LBank
Claude Opus 5.5 mới của Anthropic ngang bằng Fable với chi phí chỉ bằng 60%
anthropic-claude-opus-5-5-fable-price-comparison
Claude Opus 5.5 mới của Anthropic ngang bằng Fable với chi phí chỉ bằng 60%
Mô hình chủ lực mới của Anthropic tuyên bố đạt hiệu năng ngang tầm Fable 5.1 với chi phí chỉ bằng một phần nhỏ — nhưng GPT-6 Astra vẫn vượt mặt trên hai bài kiểm tra chuẩn đã công bố.
2026-09-22 Nguồn:decrypt.co

Tóm tắt

  • Claude Opus 5.5 ra mắt hôm thứ Ba với mức giá 4 USD và 20 USD cho mỗi triệu token đầu vào và đầu ra, rẻ hơn 40% so với Opus 5 ở cấu hình mặc định, trong khi Anthropic cho biết mô hình này ngang tầm Fable 5.1 trong phần lớn tác vụ.
  • Theo số liệu do chính Anthropic công bố, Opus 5.5 vượt Fable 5.1 và Opus 5 trong các bài kiểm tra lập trình và công việc tri thức, nhưng GPT-6 Astra vẫn nhỉnh hơn ở AutomationBench và Terminal-Bench-Science 0.1.
  • Đây là mô hình đầu tiên Anthropic phát hành kể từ khi CEO Dario Amodei kêu gọi toàn ngành làm chậm tốc độ gia tăng năng lực AI, và nó được áp dụng cùng các lớp bảo vệ an ninh mạng và sinh học như Fable 5.1.

Anthropic đã phát hành Claude Opus 5.5 vào thứ Ba, mô hình đầu tiên trong dòng mà công ty gọi là họ Claude 5.5. Anthropic cho biết mô hình mới có hiệu năng ngang với Claude Fable 5.1, flagship đắt đỏ nhất của hãng, trong phần lớn tác vụ.

Điểm đáng chú ý là chi phí vận hành mô hình này thấp hơn 20% so với Opus 5, mẫu mà nó thay thế, và rẻ hơn 60% so với Fable 5.1, sản phẩm tiên tiến nhất hiện nay của công ty.

Myriad: Công ty nào sẽ IPO tiếp theo? Nhấp để đưa ra dự đoán của bạn.

Có vẻ như đây là một mô hình rất mạnh. Nó là mô hình tiên tiến nhất cả về phiên bản (5.5 so với 5.1 của Fable) lẫn dòng sản phẩm (Opus là mô hình lớn nhất đang được cung cấp công khai, tiếp theo là Sonnet và nhỏ nhất là Haiku).

Anthropic thừa nhận khoảng cách giữa Fable và Opus hẹp hơn những gì điểm benchmark thể hiện, nhưng việc được cung cấp công khai trong gói dịch vụ và có chi phí trên mỗi token rẻ hơn khiến đây trở thành lựa chọn hiển nhiên cho phần lớn người dùng Claude.

Opus 5 ra mắt vào tháng 7 với mức giá thấp hơn và điểm số vượt Fable 5 trên phần lớn benchmark, nhưng Fable 5.1 xuất hiện vào đầu tháng 9 và đảo ngược cục diện, đánh bại Opus 5 trên mọi benchmark mà Anthropic công bố.

Opus 5.5 một lần nữa thu hẹp khoảng cách, lần này ở khía cạnh giá thay vì điểm số thô. Lovable, một nền tảng dành cho nhà phát triển từng đưa Opus 5 vào các bài kiểm tra lập trình nội bộ hồi tháng 7, cho biết trong một tuyên bố được Anthropic chia sẻ rằng mô hình trước đó “ổn định hơn, với độ biến động giữa các lần chạy thấp hơn nhiều” so với các thế hệ đi trước—đúng với thông điệp hiệu quả mà Anthropic đang tiếp tục nhấn mạnh lúc này.

Opus 5.5 cũng là mô hình đầu tiên Anthropic phát hành kể từ khi CEO Dario Amodei đăng một bài luận kêu gọi ngành AI giảm tốc, cho rằng tốc độ tăng trưởng năng lực AI đang vượt quá khả năng của các bài kiểm tra an toàn vốn được thiết kế để kiểm soát nó. “Chúng ta phải làm chậm tốc độ cải thiện năng lực của các mô hình AI,” Amodei viết hồi đầu tháng này.

Anthropic đo lường phần lớn tiến bộ này thông qua lập trình tác tử—công việc được thực hiện bởi một AI agent, tức mô hình có thể tự thực hiện chuỗi hành động nhiều bước thay vì chỉ trả lời một prompt đơn lẻ.

Trên Terminal-Bench 4.0, bộ kiểm tra đánh giá liệu một tác tử có thể hoàn thành các tác vụ nghề nghiệp phức tạp trong giao diện dòng lệnh hay không và chấm điểm theo tỷ lệ phần trăm tác vụ hoàn thành, Opus 5.5 đạt 66,4%, vượt Fable 5.1 với 55,8% và GPT-6 Astra với 57,9%. FrontierCode, bài đánh giá xem các thay đổi mã do tác tử tạo ra có thực sự được merge vào pipeline kỹ thuật thực tế hay không bằng cùng phương pháp chấm theo tỷ lệ vượt qua, chấm Opus 5.5 ở mức 54,4% so với 50,3% của Fable 5.1.

Trên GDPval-AA v2.1, bài đánh giá chất lượng công việc chuyên môn trong thế giới thực trên 44 ngành nghề bằng Elo—hệ thống xếp hạng kiểu cờ vua dùng để đo kỹ năng tương đối thay vì phần trăm cố định—Opus 5.5 đạt 1846 điểm, so với 1735 của Fable 5.1 và 1708 của Opus 5.

Tuy vậy, Opus 5.5 không dẫn đầu ở mọi mặt. Trên AutomationBench, benchmark do Zapier xây dựng để chấm xem một tác tử có thể hoàn thành trọn vẹn một quy trình công việc doanh nghiệp từ đầu đến cuối mà không cần trợ giúp của con người hay không, GPT-6 Astra đạt 41,4%, nhỉnh hơn mức 40,0% của Opus 5.5.

Trên Terminal-Bench-Science 0.1, bài kiểm tra nghiên cứu khoa học do tác tử thực hiện trong môi trường dòng lệnh bằng cùng phương pháp chấm theo tỷ lệ vượt qua, Astra đạt 64,6%, bỏ xa hơn mức 58,7% của Opus 5.5.

Điểm bán hàng lớn hơn nằm ở chi phí. Token đầu vào—các đơn vị văn bản mà mô hình đọc và ghi, được tính giá theo mỗi triệu token—nay có giá 4 USD đối với Opus 5.5 so với 5 USD của Opus 5, còn token đầu ra giảm từ 25 USD xuống 20 USD. Cache reads, tức việc tái sử dụng ngữ cảnh mà mô hình đã xử lý thay vì xử lý lại từ đầu và thường chiếm phần lớn chi phí trong các phiên lập trình tác tử kéo dài, giảm 60% xuống còn 0,20 USD cho mỗi triệu token.

Vì Opus 5.5 sánh ngang các mô hình lớp Mythos của Anthropic—cấp độ bị hạn chế nghiêm ngặt nhất của công ty, dành riêng cho các nhà nghiên cứu an ninh mạng và sinh học đã được thẩm định—ở hai năng lực đó, nên nó ra mắt với cùng các lớp bảo vệ như Fable 5.1.

Phần lớn tác vụ an ninh mạng sẽ tự động bị chuyển hướng sang Opus 4.8 cũ hơn, điều mà trước đây nhiều nhà phát triển và người dùng từng phàn nàn.

Opus 5.5 hiện đã hoạt động trên các nền tảng của Anthropic, bao gồm Amazon Web Services, Google Cloud và Microsoft Azure. Anthropic cho biết Sonnet 5.5 và Haiku 5.5 sẽ ra mắt trong vài tuần tới, với cùng đợt cắt giảm giá được áp dụng cho phần còn lại của dải sản phẩm.