
Anthropic đang mở rộng quyền truy cập vào mô hình AI Claude Mythos thông qua Project Glasswing, một chương trình nhằm giúp các công ty công nghệ và an ninh cùng các chính phủ phát hiện và sửa lỗi cũng như các lỗ hổng tiềm ẩn trước khi mô hình mạnh mẽ này được phát hành rộng rãi ra công chúng.
Trong một bài đăng blog vào thứ Ba, Anthropic cho biết họ đang bổ sung khoảng 150 tổ chức vào chương trình kiểm soát của mình khi công ty chuẩn bị cho việc phát hành rộng rãi hơn mô hình gây tranh cãi này.
Việc mở rộng diễn ra sau khi Anthropic cho biết họ dự kiến sẽ đưa các mô hình thuộc phân khúc Mythos đến tay khách hàng "trong vài tuần tới" sau khi hoàn tất các biện pháp bảo vệ bổ sung. Tin tức này cũng đến khi Anthropic chuẩn bị niêm yết công khai sau khi nộp hồ sơ IPO một cách bí mật vào thứ Hai với Ủy ban Chứng khoán và Giao dịch Hoa Kỳ.
“Sau vài tuần hợp tác chặt chẽ với các đối tác Project Glasswing của chúng tôi, ngành an ninh, những người duy trì phần mềm mã nguồn mở và chính phủ Hoa Kỳ, chúng tôi đang mở rộng quan hệ đối tác tới khoảng 150 tổ chức mới,” Anthropic viết. “Mỗi tổ chức sẽ cần phải đáp ứng các yêu cầu bảo mật của chúng tôi trước khi họ có quyền truy cập.”
Việc mở rộng Project Glasswing gần đây nhất bổ sung các tổ chức từ các lĩnh vực cơ sở hạ tầng trọng yếu, bao gồm điện, nước, y tế, truyền thông và phần cứng. Anthropic cho biết nhiều tổ chức mới này duy trì phần mềm được sử dụng bởi các chính phủ và hàng trăm triệu người.
“Điểm chung của mỗi đối tác là một cuộc tấn công thành công vào cơ sở mã của họ có thể gây thảm khốc,” Anthropic viết. “Đối với hầu hết các đối tác, chúng tôi ước tính rằng một cuộc tấn công lớn có thể ảnh hưởng đến hơn 100 triệu người, với những hệ quả quan trọng đối với cả an ninh toàn cầu và quốc gia.”
Claude Mythos ra mắt công khai vào tháng 3 sau khi các tài liệu nháp của Anthropic bị rò rỉ trực tuyến. Theo Anthropic, các tổ chức đã được cấp quyền truy cập trước đây đã sử dụng Mythos Preview để xác định hơn 10.000 lỗ hổng phần mềm nghiêm trọng hoặc cực kỳ nghiêm trọng. Các đối tác cũng đang sử dụng mô hình này để viết bản vá, thực hiện đánh giá an ninh và kiểm thử phần mềm trước khi phát hành.
Khả năng của mô hình đã làm dấy lên lo ngại trong giới nghiên cứu và các cơ quan chính phủ rằng các hệ thống AI ngày càng có khả năng cao có thể làm cho các cuộc tấn công mạng dễ thực hiện hơn.
Viện An ninh AI Vương quốc Anh báo cáo rằng Mythos đã tự động hoàn thành một cuộc tấn công mạng doanh nghiệp mô phỏng 32 bước trong quá trình thử nghiệm. Mozilla cho biết mô hình đã xác định 271 lỗ hổng mà họ đã sửa trong trình duyệt web Firefox, trong khi công ty khởi nghiệp an ninh Calif tuyên bố một phiên bản xem trước đã giúp các nhà nghiên cứu phát triển một chuỗi khai thác lỗ hổng nhắm mục tiêu vào chip máy tính M5 của Apple.
Anthropic cho biết họ đang mở rộng quyền truy cập vào Mythos vì họ tin rằng những người phòng thủ cần các công cụ AI ngày càng có khả năng cao hơn trước khi những kẻ tấn công có được khả năng tương tự. Công ty cho biết họ dự kiến các nhà phát triển khác sẽ phát hành các mô hình thuộc phân khúc Mythos trong vòng sáu đến 12 tháng, có thể không có các biện pháp bảo vệ tương đương, làm tăng khả năng xảy ra các cuộc tấn công mạng thường xuyên hơn và khó đoán hơn.
“Trong tương lai, các bản phát hành mô hình tiên tiến sẽ ngày càng có rủi ro cao. Khả năng sẽ tiếp tục được cải thiện trên tất cả các lĩnh vực, bao gồm nhiều lĩnh vực – giống như an ninh mạng – có thể trao quyền cho cả kẻ tấn công và người phòng thủ,” Anthropic viết. “Nếu thành công, chúng tôi hy vọng sẽ tạo ra một lợi thế vĩnh viễn cho những người phòng thủ.”
Anthropic đã không phản hồi ngay lập tức yêu cầu bình luận từ Decrypt.
Với việc mở rộng quyền truy cập riêng tư, người dùng trên Myriad — một nền tảng thị trường dự đoán do công ty mẹ của Decrypt, Dastan, điều hành — đang mất niềm tin rằng Claude Mythos sẽ được phát hành ra công chúng vào cuối tháng 6. Họ ước tính chỉ có 26,5% khả năng vào thời điểm viết bài này, giảm từ mức cao nhất 58,5% vào tuần trước.