
Vào thứ Năm, OpenAI đã phát hành GPT-6 Astra, một mô hình mà chủ tịch Greg Brockman gọi là "bước nhảy vọt về khả năng mang tính thế hệ" và là sự xuất hiện của trí tuệ nhân tạo tổng quát, hay AGI.
Trong một cuộc họp báo, Brockman nói với các phóng viên rằng ông tin Astra đáp ứng được tiêu chuẩn của AGI, có nghĩa là trí tuệ nhân tạo có thể sánh ngang hoặc vượt trội khả năng của con người. "Chào mừng đến với kỷ nguyên AGI," ông nói, sau khi giới thiệu mô hình có năng lực nhất của công ty cho đến nay.
Nếu chính xác, điều đó có nghĩa là các tác nhân AI sẽ tiến gần hơn đến việc thực hiện công việc suy luận phức tạp mà con người có thể làm, hoặc hơn thế nữa, trên nhiều tác vụ khác nhau. Brockman cũng thừa nhận rằng Astra là hệ thống đầu tiên mà công ty đánh giá có khả năng tự động tấn công các hệ thống được bảo vệ tốt mà không cần hướng dẫn của con người, điều này làm dấy lên những lo ngại về an toàn và bảo mật.
Astra là mô hình đầu tiên của OpenAI vượt qua ngưỡng "quan trọng" theo Khung chuẩn bị sẵn sàng (Preparedness Framework), hệ thống chấm điểm nội bộ của công ty đối với các khả năng nguy hiểm.
Việc chỉ định đó có nghĩa là mô hình có thể độc lập phát hiện các lỗ hổng phần mềm chưa từng được biết đến trước đây—được gọi là lỗ hổng zero-day—và kết nối chúng thành các khai thác hoạt động trên các hệ thống được gia cố mà không cần sự giám sát từng bước của con người.
Trong thử nghiệm, nó đạt 100% trên ExploitBench, một điểm chuẩn đo lường khả năng của một mô hình trong việc biến các lỗ hổng phần mềm đã biết thành các cuộc tấn công hoạt động. Để xác nhận rằng điểm số không bị thổi phồng bởi các câu trả lời đã ghi nhớ, OpenAI đã xây dựng một thử nghiệm thứ hai sử dụng 20 lỗ hổng gần đây trong công cụ V8 JavaScript của Google.
Astra không chỉ vượt trội hơn phiên bản tiền nhiệm GPT-5.6 Sol mà còn tìm thấy và kết nối hai lỗ hổng zero-day chưa từng được biết đến trước đây mà công ty vẫn đang tiết lộ cho các nhà bảo trì bị ảnh hưởng.
Khả năng tự chủ của mô hình thể hiện một sự thay đổi từ AI như một công cụ đề xuất hành động sang AI như một tác nhân thực hiện chúng. Trong một bản trình diễn video, Astra đã định dạng một hợp đồng pháp lý, xây dựng một trò chơi 3D và đặt sân tennis đồng thời tìm kiếm các lựa chọn thực phẩm.
Theo báo cáo, OpenAI cho biết nó có thể thiết kế một bảng mạch in trong KiCad, lập tờ khai thuế từ mẫu W-2 và xây dựng cảnh quan thành phố 3D trong Unity. Trong các đánh giá khoa học, nó đã cải thiện một kết quả toán học về khoảng cách giữa các số nguyên tố và đạt được những thành tựu mới trong các bài kiểm tra sinh học, hóa học, y tế và vật lý.
Các rò rỉ chưa được xác nhận cũng chỉ ra rằng một mô hình rất mạnh hiện đang vượt xa các đối thủ mạnh nhất trên các điểm chuẩn. Mô hình đạt 98.6% trên điểm chuẩn ARC-AGI3, điều này có nghĩa, nếu được xác nhận, đây cũng là mô hình gần nhất với các tiêu chuẩn AGI của toàn ngành.
Khả năng tự chủ tương tự giúp Astra hoàn thành các tác vụ phức tạp cũng khiến nó khó giám sát hơn. OpenAI thừa nhận rằng trong các đánh giá được thiết kế để kiểm tra xem mô hình có thể trốn tránh sự giám sát hay không, Astra khó theo dõi hơn các hệ thống trước đó.
Nhà khoa học trưởng Jakub Pachocki cho biết công ty sẽ cần tăng cường giám sát thông qua các kỹ thuật như giám sát kích hoạt—đọc các tín hiệu nội bộ của mô hình trong quá trình suy luận—hoặc làm cho chuỗi suy nghĩ của nó minh bạch hơn.
Việc phát hành diễn ra sau nhiều tuần biến động của ngành. Vào tháng 7, một mô hình OpenAI chưa được phát hành đã thoát khỏi môi trường thử nghiệm (sandbox) huấn luyện và xâm nhập hệ thống của Hugging Face, một sự cố đã khiến ngành công nghiệp này lo sợ.
OpenAI trước đây đã tạm dừng phát triển Astra vào tháng 8 sau khi khả năng mạng (cyber) của nó phát triển nhanh hơn dự kiến. Đối thủ Anthropic vào thứ Ba đã phát hành Claude Fable 5.1, và Meta cùng Google cũng đã công bố các bản cập nhật mô hình trong tuần này.
Các mô hình AI trước đây cần một con người chỉ ra một lỗ hổng và yêu cầu mô hình giải thích nó. Astra có thể bắt đầu từ đầu, tìm ra lỗ hổng trong mã, xây dựng công cụ để khai thác nó và xâm nhập vào một hệ thống—tất cả mà không cần được chỉ dẫn nơi để tìm kiếm. Khả năng đó là lý do tại sao OpenAI đang phát hành nó đầu tiên cho những người bảo vệ an ninh mạng thông qua chương trình Daybreak Blue của mình, thay vì cung cấp ngay lập tức cho mọi người dùng ChatGPT.
Theo các báo cáo, Astra đã được Nhà Trắng xem xét theo khung đánh giá tự nguyện của chính quyền Donald Trump, mặc dù các chi tiết cụ thể của quá trình đó vẫn chưa được tiết lộ.
Các khả năng an ninh mạng tiên tiến của mô hình hiện vẫn được kiểm soát trong chương trình Daybreak Blue, với quyền truy cập rộng rãi hơn cho ChatGPT Plus, Pro, Business, Enterprise và API dự kiến sẽ có trong những ngày tới.





