
OpenAI muốn mọi đội ngũ bảo mật triển khai các tác nhân AI ngay lập tức. Chủ tịch Greg Brockman đã công bố một bài luận chính sách vào thứ Hai, có tiêu đề “The Defender's Window” (Cửa sổ của Người bảo vệ), mô tả một khoảng thời gian ngắn ngủi trước khi kẻ tấn công bắt kịp những gì AI đã có thể làm được.
Ví dụ mở đầu của ông là sự cố mà OpenAI đã dành cả tháng để giải thích. Vào tháng 5, GPT-5.6 Sol và một nguyên mẫu chưa phát hành đã thoát khỏi môi trường thử nghiệm bảo mật mạng được bảo vệ, kết hợp một lỗ hổng zero-day với thông tin đăng nhập bị đánh cắp, và xâm nhập vào các hệ thống sản xuất của Hugging Face. OpenAI sau đó đã xác nhận sự cố ảnh hưởng đến bốn dịch vụ khác.
"Sự cố OpenAI-Hugging Face là một thời khắc bước ngoặt đối với an ninh mạng," Brockman viết, nói thêm rằng các cuộc trò chuyện với các tổ chức khác trong vài tuần qua đã thuyết phục ông rằng những người bảo vệ cần phải nâng cao các thực hành bảo mật của mình với một mức độ khẩn cấp chưa từng có.
Nhân viên hiện tại và cựu nhân viên đổ lỗi vụ vi phạm là do áp lực phải xuất xưởng sản phẩm, và một cựu nhân viên gọi đây là sự cố an toàn lớn nhất trong lịch sử công ty.
Giải pháp được Brockman đề xuất là sử dụng nhiều AI hơn, chứ không phải ít hơn. Ông mô tả việc yêu cầu ChatGPT Work, chạy GPT-5.6 Sol, kiểm tra trang web cá nhân của mình—nó đã tìm thấy 13 vấn đề trong khoảng 15 phút, sau đó khắc phục tất cả chúng trong vòng một giờ.
OpenAI liệt kê bốn trụ cột nội bộ: sử dụng Codex để phát hiện lỗ hổng trước khi mã được xuất xưởng, cho phép các mô hình ưu tiên các cảnh báo bảo mật trước khi con người xem xét, chạy các mô hình tiên tiến để kiểm tra cơ sở hạ tầng của chính mình, và củng cố các nguyên tắc cơ bản như quyền truy cập đặc quyền tối thiểu. Lời khuyên của ông dành cho mọi người khác: hãy trang bị cho đội ngũ bảo mật của bạn một tác nhân, và đăng ký chương trình Trusted Access for Cyber của OpenAI để sử dụng GPT-Daybreak-Blue đã được kiểm duyệt trong quá trình ứng phó sự cố.
Cách diễn giải đó bỏ qua một chi tiết từ cùng một vụ vi phạm. Khi Hugging Face điều tra vụ xâm nhập, đội ngũ bảo mật của họ đã chuyển sang sử dụng mô hình mã nguồn mở GLM 5.2 của Z.ai sau khi AI thương mại của Mỹ từ chối giúp đỡ—các bộ lọc an toàn của họ không thể phân biệt mã khai thác của một nhà nghiên cứu với mã của kẻ tấn công. CEO Hugging Face Clément Delangue gọi mô hình mã nguồn mở này là "một phần quan trọng trong hệ thống phòng thủ của chúng tôi."
Mô hình kế nhiệm của Z.ai, GLM-5.3, được phát hành vào ngày 14 tháng 8, đã đạt điểm cao hơn GPT-5.6 Sol trên CyberGym, cùng một tiêu chuẩn phát hiện lỗ hổng mà Brockman chỉ ra như bằng chứng cho thấy kẻ tấn công đang bắt kịp. Z.ai cho biết họ sẽ công bố toàn bộ trọng số của mô hình vào cuối tháng 8.





