
Payward, công ty mẹ của sàn giao dịch tiền điện tử Kraken, đã tham gia Dự án Glasswing của Anthropic vào ngày 17 tháng 8 và được cấp quyền truy cập hạn chế vào Claude Mythos 5 để phục vụ công tác an ninh mạng phòng thủ.
Công ty có kế hoạch sử dụng mô hình trí tuệ nhân tạo để quét các môi trường phần mềm của mình tìm lỗ hổng trong những tuần tới. Các phát hiện sẽ được đưa vào quy trình xem xét bảo mật hiện có của Payward thay vì tự động tạo ra các thay đổi phần mềm.
Payward cũng cho biết họ có ý định tiết lộ các lỗ hổng đã được xác thực ảnh hưởng đến các dự án nguồn mở của bên thứ ba cho những người bảo trì của chúng. Công ty không xác định mục tiêu quét đầu tiên của mình, công bố lịch triển khai hoặc tiết lộ chi phí truy cập Mythos 5.
Payward cho biết Claude Mythos 5 sẽ kiểm tra tất cả các môi trường của công ty để tìm các điểm yếu phần mềm. Cơ sở hạ tầng của họ hỗ trợ các dịch vụ giao dịch tài sản kỹ thuật số, lưu ký và thanh toán luôn hoạt động liên tục.
Thông báo không chỉ rõ liệu Mythos 5 sẽ được cấp quyền truy cập vào các hệ thống sản xuất, các bản sao mã nguồn được cô lập hay các môi trường thử nghiệm có kiểm soát. Payward cũng không mô tả cách nhóm bảo mật của họ sẽ xác thực các phát hiện trước khi phê duyệt các bản vá.
Các kết quả dương tính giả vẫn là một mối lo ngại thực tế khi các hệ thống trí tuệ nhân tạo xem xét phần mềm phức tạp. Một mô hình có thể xác định mã không thể truy cập, trùng lặp một báo cáo hiện có hoặc hiểu sai cách một thành phần hoạt động trong môi trường sản xuất. Do đó, cần có sự xem xét của con người trước khi các nhóm phân loại một vấn đề là lỗ hổng.
Ethereum Foundation cũng đưa ra kết luận tương tự khi thử nghiệm các tác nhân bảo mật AI. Theo báo cáo của crypto.news, các nhà nghiên cứu của họ phát hiện ra rằng các báo cáo lỗ hổng do AI tạo ra vẫn yêu cầu xác thực độc lập bởi con người, đặc biệt khi các tác nhân kiểm tra mã giao thức phức tạp.
Đồng Giám đốc điều hành của Payward, Arjun Sethi, cho biết AI có thể thay đổi sự mất cân bằng giữa những kẻ tấn công và những người bảo vệ bằng cách đọc mã ở quy mô lớn hơn.
“Một mô hình có thể đọc mọi dòng mã theo cách mà kẻ tấn công sẽ làm, ở quy mô máy móc, vì vậy chúng tôi tìm ra lỗ hổng trước khi bất kỳ ai có thể xây dựng khai thác,” Sethi nói.
Tuyên bố này mô tả lợi thế phòng thủ mà Payward mong muốn. Công ty vẫn chưa công bố kết quả cho thấy Mythos 5 đã tìm thấy bao nhiêu lỗ hổng hợp lệ trong các hệ thống của mình.
Anthropic đã ra mắt Dự án Glasswing vào tháng 4 năm 2026 để cấp quyền truy cập sớm vào các mô hình an ninh mạng mạnh nhất của mình cho các nhà cung cấp cơ sở hạ tầng và những người bảo trì phần mềm được chọn.
Các bên tham gia ban đầu bao gồm Amazon Web Services, Apple, Cisco, CrowdStrike, Google, JPMorganChase, Microsoft, Nvidia, Palo Alto Networks và Linux Foundation. Sau đó, Anthropic đã mở rộng sáng kiến này tới khoảng 150 tổ chức trên hơn 15 quốc gia.
Công ty cho biết các tổ chức tham gia phải đáp ứng các yêu cầu bảo mật trước khi được cấp quyền truy cập. Mythos 5 không có sẵn rộng rãi vì các khả năng tương tự được sử dụng để xác định lỗ hổng cũng có thể giúp tạo ra các khai thác (exploit) hoạt động.
Như đã báo cáo trước đây, Anthropic đã khôi phục quyền truy cập Mythos chỉ cho các tổ chức Hoa Kỳ đã được kiểm duyệt sau khi chính phủ Hoa Kỳ dỡ bỏ các hạn chế xuất khẩu tạm thời. Mô hình Claude Fable 5 được bảo vệ đã trở lại khả dụng rộng rãi hơn.
Payward cho biết việc họ được cấp quyền truy cập là theo quyết định của Hoa Kỳ cho phép Mythos 5 tiếp cận các tổ chức vận hành và bảo vệ cơ sở hạ tầng quan trọng. Trang mô hình chính thức của Anthropic xác nhận rằng quyền truy cập đã được khôi phục cho một nhóm các tổ chức Hoa Kỳ sau khi chính phủ phê duyệt.
Cả Anthropic và chính phủ Hoa Kỳ đều chưa công khai chỉ định mọi nền tảng tài sản kỹ thuật số là cơ sở hạ tầng quan trọng. Tuyên bố của Payward rằng các nền tảng như vậy “thuộc về danh sách đó” thể hiện quan điểm của công ty chứ không phải là một phân loại chính thức của chính phủ.
Anthropic mô tả Claude Mythos 5 là mô hình có khả năng nhất của họ cho nghiên cứu an ninh mạng và sinh học. Mô hình có thể kiểm tra mã, xác định các điểm yếu, đề xuất các bản vá và hỗ trợ các nhà nghiên cứu được phê duyệt thử nghiệm các con đường khai thác.
Phiên bản xem trước Mythos trước đây của Dự án Glasswing được cho là đã tìm thấy hơn 10.000 lỗ hổng được phân loại là mức độ nghiêm trọng cao hoặc cực kỳ nghiêm trọng trên các phần mềm được sử dụng rộng rãi. Bảng điều khiển công bố phối hợp của Anthropic cho thấy 1.596 lỗ hổng được báo cáo trên 281 dự án nguồn mở tính đến ngày 22 tháng 5.
Những con số đó là các phép đo của Anthropic và không có nghĩa là mọi phát hiện ban đầu của mô hình đều hợp lệ. Bảng điều khiển của họ ghi nhận tỷ lệ dương tính thật là 90,8% trong số 1.900 ứng viên được các công ty bảo mật bên ngoài xem xét.
Anthropic cho biết việc phân loại ban đầu độc lập bởi con người vẫn là giai đoạn hạn chế. Chỉ có 97 phát hiện được liệt kê đã được vá lên nguồn (upstream) tại thời điểm cập nhật bảng điều khiển, trong khi 88 phát hiện đã nhận được mã định danh cảnh báo công khai.
Mô hình cũng có thể tạo ra các thành phần khai thác và kết hợp chúng thành các chuỗi tấn công. Anthropic đã viện dẫn khả năng lưỡng dụng này khi giải thích tại sao Mythos 5 vẫn bị giới hạn cho các đối tác đã được phê duyệt.
Trong các tin tức liên quan, các nhà nghiên cứu phát hiện ra rằng các mô hình thuộc lớp Mythos có thể biến các lỗi phần mềm thành các chuỗi khai thác hoạt động. Do đó, việc tiếp cận rộng rãi hơn sẽ cung cấp cho những kẻ tấn công một số khả năng tương tự như những gì có sẵn cho những người phòng thủ.
Payward cho biết các lỗ hổng được phát hiện trong mã nguồn của bên thứ ba sẽ được gửi đến những người bảo trì dự án có liên quan. Họ trình bày quy trình đó như một cách để bảo vệ các tổ chức khác đang sử dụng cùng phần mềm.
Công ty không công bố chính sách tiết lộ phối hợp cho sáng kiến này. Các chi tiết quan trọng chưa được trả lời bao gồm thời gian những người bảo trì sẽ phải vá các lỗ hổng, những phát hiện nào Payward có thể công khai và cách họ sẽ xử lý các dự án không phản hồi.
Tiết lộ có trách nhiệm thông thường yêu cầu các nhà nghiên cứu xác minh một lỗ hổng, liên hệ riêng với người bảo trì và cho phép thời gian để khắc phục trước khi công bố thông tin kỹ thuật. Việc công bố sớm có thể khiến người dùng gặp rủi ro trước khi bản vá có sẵn.
Payward trước đây đã phải đối mặt với các tranh chấp liên quan đến nghiên cứu bảo mật. Theo báo cáo của crypto.news, Kraken đã vá một lỗ hổng gửi tiền mà các nhà nghiên cứu đã sử dụng để rút gần 3 triệu đô la. Sàn giao dịch sau đó đã thu hồi được số tiền này sau một cuộc tranh cãi công khai với CertiK.
Vụ việc đó không liên quan đến Dự án Glasswing, nhưng nó cho thấy tại sao các quy tắc kiểm thử và tiết lộ rõ ràng lại quan trọng. Việc quét bằng AI có thể làm tăng số lượng các phát hiện được báo cáo, tạo thêm công việc cho các nhóm bảo mật và những người bảo trì.
Payward có kế hoạch bắt đầu quét các môi trường của mình trong vòng vài tuần. Các cập nhật có thể xác minh tiếp theo sẽ bao gồm các lỗ hổng đã được xác nhận, các bản vá đã hoàn thành hoặc các tiết lộ công khai được phối hợp với các dự án nguồn mở bị ảnh hưởng.
Không có mục tiêu hiệu suất nào được công bố. Payward không cho biết Mythos 5 sẽ quét các hệ thống của họ thường xuyên như thế nào hoặc liệu mô hình có xem xét mã mới trước khi triển khai hay không.
Anthropic yêu cầu khách hàng Mythos 5 chấp nhận giữ lại dữ liệu trong ba mươi ngày để giám sát an toàn. Payward chưa giải thích mã hoặc thông tin hệ thống nào sẽ được gửi, dữ liệu nhạy cảm sẽ được tách riêng như thế nào hoặc liệu thông tin khách hàng có nằm ngoài quy trình quét hay không.
Hiện tại, diễn biến được xác nhận là việc Payward được chấp nhận vào Dự án Glasswing và kế hoạch sử dụng Claude Mythos 5. Việc mô hình có cải thiện bảo mật của công ty hay không sẽ phụ thuộc vào chất lượng các phát hiện của nó, quá trình xác minh của con người và tốc độ của các bản vá tiếp theo.





