Trang chủTrung tâm tin tức LBank
Astra của OpenAI trở thành mô hình AI đầu tiên của hãng với khả năng hack ở mức "nghiêm trọng"
openai-astra-first-ai-model-critical-hacking
Astra của OpenAI trở thành mô hình AI đầu tiên của hãng với khả năng hack ở mức "nghiêm trọng"
Mô hình chưa được phát hành có thể phát hiện các lỗ hổng zero-day và kết hợp chúng thành các exploit hoạt động mà không cần con người hướng dẫn từng bước, và quyền truy cập vào khả năng đó đang bắt đầu với một nhóm nhỏ người thử nghiệm.
2026-09-02 Nguồn:decrypt.co

Tóm tắt

  • OpenAI cho biết vào ngày 1 tháng 9 rằng Astra đạt cấp độ "Nghiêm trọng" trong Khung chuẩn bị của họ, là mô hình đầu tiên mà công ty xếp hạng cao như vậy về an ninh mạng.
  • Astra đạt điểm tuyệt đối 100% trên ExploitBench và, trong một thử nghiệm nội bộ mới hơn được xây dựng từ các lỗ hổng trình duyệt V8 được tiết lộ vào mùa hè này, đã tự mình phát hiện và liên kết hai lỗ hổng zero-day chưa từng được biết đến trước đây.
  • Quyền truy cập vào các khả năng an ninh mạng tiên tiến của Astra bắt đầu với một nhóm nhỏ những người thử nghiệm alpha.

OpenAI cho biết hôm thứ Ba rằng Astra, một mô hình chưa được phát hành, đã vượt qua ngưỡng "nghiêm trọng" về khả năng an ninh mạng theo Khung chuẩn bị của họ, là mô hình đầu tiên mà công ty xếp vào danh mục này.

Điều đó có nghĩa là Astra, mà nhiều người tin là GPT-6 thay vì một mô hình bổ sung, có thể tìm thấy các lỗ hổng bảo mật chưa từng được biết đến trước đây và xây dựng các khai thác hoạt động trên nhiều hệ thống được bảo vệ kiên cố mà không cần con người hướng dẫn từng bước.

Myriad: Khi nào OpenAI sẽ phát hành GPT-6? Nhấn để đưa ra dự đoán của bạn.

“Chúng tôi hiện tin rằng Astra đạt ngưỡng khả năng an ninh mạng Nghiêm trọng theo Khung chuẩn bị của chúng tôi,” OpenAI viết. “Đây là mô hình đầu tiên chúng tôi chỉ định ở cấp độ này và đòi hỏi các biện pháp bảo vệ mạnh mẽ hơn trong quá trình phát triển và trước khi phát hành.”

Theo khung này, một mô hình đạt mức nghiêm trọng nếu nó có thể độc lập phát triển các khai thác zero-day có chức năng trên nhiều hệ thống thực tế được bảo vệ kiên cố, hoặc nếu nó có thể lập kế hoạch và thực hiện toàn bộ một cuộc tấn công mạng chống lại một mục tiêu khó khăn chỉ từ một mục tiêu cấp cao. Các mô hình OpenAI trước đây, bao gồm GPT-5.6 Sol, chỉ đạt tối đa ở cấp độ "cao" thấp hơn của khung.

Trên ExploitBench, một điểm chuẩn kiểm tra xem một mô hình có thể biến các lỗ hổng phần mềm đã biết thành các khai thác hoạt động và ghi điểm dưới dạng tỷ lệ đạt thẳng, Astra đã đạt 100% tuyệt đối.

Để loại bỏ các câu trả lời ghi nhớ làm tăng điểm số đó, OpenAI đã xây dựng một thử nghiệm thứ hai sử dụng 20 lỗ hổng nghiêm trọng trong công cụ JavaScript V8 của Google được tiết lộ từ tháng 6 đến tháng 8. Astra đã đánh bại GPT-5.6 Sol về tỷ lệ thực thi mã tùy ý ở đó, sử dụng ít token đầu ra hơn đáng kể, và trên đường đi nó đã tìm thấy và liên kết hai lỗ hổng zero-day mà OpenAI vẫn đang tiết lộ cho các nhà bảo trì bị ảnh hưởng.

GPT-5.6 Sol hiện là mô hình tốt nhất của OpenAI.

Trong các thử nghiệm thực tế chống lại một trình duyệt được bảo vệ kiên cố và một hệ điều hành được bảo vệ kiên cố, Astra đã xây dựng một chuỗi tấn công đầy đủ phá vỡ môi trường bảo mật của trình duyệt và chạy lệnh trên máy chủ chỉ bằng cách mở một tệp HTML độc hại. Nó cũng tìm thấy nhiều lỗ hổng trong hệ điều hành được bảo vệ kiên cố và xâu chuỗi chúng thành một con đường leo thang đặc quyền từ tài khoản người dùng thông thường lên quyền root.

OpenAI cho biết mô hình này từ chối 91,5% các nỗ lực jailbreak mạng trong thử nghiệm của chính nó, tăng từ 59% đối với GPT-5.6 Sol. Quyền truy cập vào các khả năng an ninh mạng tiên tiến nhất của Astra bắt đầu với một nhóm nhỏ những người thử nghiệm alpha, với quyền truy cập rộng rãi hơn sẽ được triển khai sau thông qua chương trình Daybreak Blue của OpenAI dành cho công việc an ninh phòng thủ.

Thông tin tiết lộ này diễn ra sau nhiều tuần lo lắng trong ngành. Chỉ vài ngày trước, OpenAI đã tạm dừng phát triển Astra sau khi các kỹ năng mạng và mã hóa của mô hình tiến bộ nhanh chóng, một cảnh báo xuất hiện sau khi một hệ thống OpenAI riêng biệt, chưa được phát hành, đã liên kết các lỗ hổng để xâm phạm Hugging Face trong khi thao túng một điểm chuẩn bảo mật. OpenAI cho biết Astra không có vai trò trong vụ việc đó.

Các nhà giao dịch đã định giá một sự thay đổi nhanh chóng. Các thị trường dự đoán trên Myriad được theo dõi bởi Decrypt đã đưa ra tỷ lệ 72% cho việc Astra, được nội bộ gắn với tên mã GPT-6, sẽ được phát hành công khai vào ngày 30 tháng 9 ngay cả sau khi OpenAI tạm dừng vào đầu tháng 8, và OpenAI vẫn chưa ấn định ngày ra mắt công khai. Các tỷ lệ này đã thay đổi 55% ủng hộ việc phát hành vào tháng 11 năm 2026.

Thời điểm này đặt Astra đối đầu với một đối thủ mới. Anthropic đã phát hành Fable 5.1 và Mythos 5.1 vào thứ Ba, và Mythos 5.1, giống như Mythos 5 trước đó, được dành riêng cho các tổ chức an ninh mạng và khoa học đời sống được kiểm định chứ không phải công chúng.

Decrypt đã báo cáo vào tháng 6 rằng GPT-5.5-Cyber của OpenAI đã vượt qua Mythos 5 trên CyberGym, một điểm chuẩn chạy các tác nhân AI chống lại hơn 1.500 lỗ hổng đã biết từ các dự án mã nguồn mở thực tế và chấm điểm chúng dựa trên số lượng chúng tái tạo chính xác.

Cả hai công ty đã được đồn đại là đang chuẩn bị các mô hình tiên phong mới trong cùng một khoảng thời gian, và giờ đây họ đã làm được. Fable 5.1 ra mắt vào ngày 1 tháng 9, và OpenAI cho biết Astra sẽ sớm ra mắt, với các công cụ mạng mạnh nhất của nó được cấp quyền truy cập alpha trước và Daybreak Blue sau đó.