
Vào thứ Ba, Anthropic đã công bố ra mắt chính thức Claude Mythos 5, một mô hình AI truy cập hạn chế mà công ty cho biết có khả năng an ninh mạng chưa từng có, cùng với Claude Fable 5, một phiên bản được thiết kế để sử dụng rộng rãi hơn cho công chúng.
Trong một bài đăng trên blog, Anthropic cho biết Mythos 5 ban đầu sẽ chỉ có sẵn cho các tổ chức an ninh mạng được phê duyệt, các nhà khai thác cơ sở hạ tầng quan trọng, các đối tác chính phủ và các nhà nghiên cứu khoa học sự sống được chọn. Công ty cho biết các mô hình AI thuộc lớp Mythos “đã đạt đến ngưỡng mà chúng gây ra rủi ro đáng kể.”
“Vào tháng 4, chúng tôi đã bắt đầu Dự án Glasswing, phát hành mô hình lớp Mythos đầu tiên (Claude Mythos Preview) chỉ cho một nhóm hạn chế các nhà bảo vệ không gian mạng và nhà cung cấp cơ sở hạ tầng phần mềm quan trọng,” Anthropic viết. “Khi làm như vậy, chúng tôi đã nói rằng chúng tôi hy vọng cuối cùng sẽ phát hành các khả năng cấp độ Mythos cho tất cả người dùng của chúng tôi, miễn là chúng tôi đã phát triển các biện pháp bảo vệ mới đủ mạnh để ngăn chặn lạm dụng một cách đáng tin cậy.”
Việc ra mắt diễn ra sau nhiều tháng lo ngại về khả năng của Mythos trong việc xác định các lỗ hổng phần mềm và thực hiện các hoạt động an ninh mạng phức tạp sau khi tin tức về AI bị rò rỉ trực tuyến vào tháng 3. Đầu năm nay, Viện An ninh AI của Vương quốc Anh đã báo cáo rằng một phiên bản xem trước đã trở thành mô hình AI đầu tiên hoàn thành bài tập xâm nhập mạng doanh nghiệp 32 bước mà không cần sự hỗ trợ của con người. Vào tháng 4, Mozilla đã báo cáo rằng một phiên bản xem trước của Mythos đã phát hiện hơn 271 lỗ hổng trong trình duyệt Firefox.
Giới thiệu Claude Fable 5: một mô hình lớp Mythos mà chúng tôi đã làm cho an toàn để sử dụng chung.
Khả năng của nó vượt trội so với bất kỳ mô hình nào chúng tôi từng cung cấp rộng rãi. pic.twitter.com/2AvmEjHIX8
— Claude (@claudeai) June 9, 2026
Cho đến nay, Anthropic đã hạn chế quyền truy cập vào Mythos thông qua chương trình Dự án Glasswing của mình trong khi các nhà nghiên cứu đánh giá rủi ro. Trong một bài đăng tiếp theo trên X, Anthropic cho biết họ sẽ tiếp tục mở rộng quyền truy cập vào Mythos “thông qua một chương trình truy cập đáng tin cậy rộng hơn” cho công việc an ninh mạng và nghiên cứu y sinh.
Việc ra mắt Mythos cũng diễn ra trong bối cảnh căng thẳng giữa Anthropic và chính quyền Tổng thống Donald Trump dường như đang dịu đi sau một cuộc tranh cãi công khai về việc sử dụng Claude cho các hoạt động quân sự.
“Tham vấn với chính phủ Hoa Kỳ, chúng tôi dự định sẽ dần dần mở rộng quyền truy cập vào Claude Mythos 5, tiếp tục bổ sung định kỳ các đối tác mới, cũng như theo đuổi một chương trình truy cập đáng tin cậy cho phép các tổ chức an ninh mạng đăng ký một cách có hệ thống hơn,” Anthropic viết, đồng thời cho biết người dùng Mythos Preview có thể nâng cấp lên Mythos 5.
Đầu tháng này, các báo cáo của báo chí cho biết Anthropic đã cử các kỹ sư của mình đến Cơ quan An ninh Quốc gia để giúp triển khai mô hình AI Mythos của họ cho các hoạt động an ninh mạng, được cho là nhắm mục tiêu vào Trung Quốc và Iran.
Cùng với Mythos 5, Anthropic đã phát hành Claude Fable 5, một mô hình AI thuộc lớp Mythos sử dụng cùng thiết kế cốt lõi của Mythos 5 nhưng có thêm các biện pháp bảo vệ cho công chúng.
“Khả năng của Fable 5 vượt trội so với bất kỳ mô hình nào chúng tôi từng cung cấp rộng rãi,” Anthropic viết. “Nó là mô hình tiên tiến nhất trên gần như tất cả các tiêu chuẩn kiểm tra khả năng AI, cho thấy hiệu suất vượt trội trong kỹ thuật phần mềm, công việc tri thức, thị giác máy tính, nghiên cứu khoa học và nhiều lĩnh vực khác.”
Theo Anthropic, Mythos 5 và Fable 5 đã đạt điểm cao nhất trên một số tiêu chuẩn kỹ thuật phần mềm, an ninh mạng, sinh học và lý luận. Công ty báo cáo đạt 78% điểm trên ExploitBench, thước đo phát hiện và khai thác lỗ hổng, và 88% điểm trên tiêu chuẩn mã hóa Terminal-Bench. Anthropic cho biết kết quả này cho thấy các mô hình có thể xử lý các tác vụ dài hơn và phức tạp hơn so với các hệ thống Claude trước đây.
Trong khi Anthropic cho biết Fable 5 hoạt động đặc biệt tốt trên các tác vụ dài, phức tạp, thì để ngăn chặn việc lạm dụng, các yêu cầu liên quan đến an ninh mạng, sinh học, hóa học hoặc sao chép mô hình AI được xử lý bởi Claude Opus 4.8 – một biện pháp bảo vệ mà công ty cho biết được kích hoạt trong ít hơn 5% các phiên làm việc.
“Việc phát hành một mô hình có khả năng như vậy đi kèm với nhiều rủi ro,” Anthropic viết. “Nếu không có các biện pháp bảo vệ, khả năng của Fable 5 trong các lĩnh vực như an ninh mạng có thể bị lạm dụng để gây ra thiệt hại nghiêm trọng.”
Việc ra mắt diễn ra khi các nhà phát triển AI đối mặt với những câu hỏi ngày càng tăng về cách phát hành các hệ thống ngày càng có khả năng. Anthropic đã lập luận rằng Mythos có thể giúp các nhà bảo vệ tìm và khắc phục các lỗ hổng trước khi kẻ tấn công khai thác chúng. Đồng thời, các nhà phê bình, bao gồm CEO của OpenAI Sam Altman, đã cáo buộc công ty sử dụng “marketing dựa trên nỗi sợ hãi” để bán các mô hình AI của mình.