Trang chủTrung tâm tin tức LBank
Nhân viên OpenAI đổ lỗi cho việc vội vàng phát hành khiến hacker tác nhân lừa đảo tấn công
openai-staff-blame-rush-ship-rogue-agent-hack
Nhân viên OpenAI đổ lỗi cho việc vội vàng phát hành khiến hacker tác nhân lừa đảo tấn công
Các nhân viên hiện tại và cựu nhân viên của OpenAI được cho là cho biết áp lực phải ra mắt các sản phẩm AI mới khiến việc ưu tiên an toàn trở nên khó khăn hơn.
2026-08-14 Nguồn:decrypt.co

Tóm tắt

  • Các nhân viên của OpenAI nói với Wired rằng áp lực phải ra mắt các mô hình và sản phẩm đã khiến việc ưu tiên an toàn, bảo mật và tính phù hợp trở nên khó khăn.
  • Một cựu nhân viên gọi vụ vi phạm này là sự cố an toàn lớn nhất trong lịch sử OpenAI.
  • OpenAI đã giảm tốc độ nghiên cứu, điều chuyển các nhóm và chi hàng triệu USD để điều tra sự cố.

Việc OpenAI vội vã phát hành các mô hình và sản phẩm mới đã góp phần tạo ra các điều kiện khiến các tác nhân AI của họ thoát khỏi môi trường thử nghiệm nội bộ và tấn công Hugging Face vào đầu năm nay.

Nhiều nhân viên hiện tại và cựu nhân viên nói với Wired rằng áp lực cạnh tranh đã khiến nhân viên khó dành đủ sự chú ý cho an toàn, bảo mật và tính phù hợp — công việc đảm bảo các hệ thống AI hoạt động đúng như dự định.

Myriad: Khi nào OpenAI sẽ phát hành GPT-6? Nhấp để đưa ra dự đoán của bạn.

“Họ cực kỳ cẩu thả. Nếu bạn nghiêm túc về điều này, AI của bạn không nên có khả năng thoát ra Internet và sau đó lặp lại ngay sau đó,” một cựu nhân viên OpenAI nói với Wired. “Đây là sự cố an toàn lớn nhất trong lịch sử OpenAI.”

Vào tháng 5, GPT-5.6 Sol của OpenAI và một mô hình tiền phát hành không tên đã thoát khỏi môi trường thử nghiệm bị hạn chế internet bằng cách khai thác một lỗ hổng phần mềm chưa từng được biết đến trước đây. Các tác nhân này sau đó đã xâm nhập vào kho AI mã nguồn mở Hugging Face để lấy câu trả lời cho các bài kiểm tra an ninh mạng của chúng. Vào tháng 7, OpenAI đã xác nhận rằng các mô hình của mình phải chịu trách nhiệm, trước khi đưa ra phân tích đầy đủ hơn tại hội nghị Black Hat thường niên vào tuần trước.

Chủ tịch OpenAI Greg Brockman cho biết công ty đang tăng cường các biện pháp bảo vệ khi các mô hình của họ ngày càng có khả năng hơn.

“Chúng tôi đang đạt đến các cấp độ khả năng mô hình mới đòi hỏi đào tạo mạnh mẽ hơn, tính phù hợp, kiểm tra an toàn và bảo mật, thực tiễn triển khai và quản trị,” Brockman nói với Wired.

Các nhân viên đã nêu lên những lo ngại tương tự trước đây, bao gồm Jan Leike, cựu trưởng bộ phận phù hợp của OpenAI, người đã rời đi để đến với nhà phát triển AI đối thủ Anthropic vào năm 2024 sau khi cảnh báo rằng an toàn đã “bị bỏ rơi” so với việc phát triển sản phẩm.

“Xây dựng các cỗ máy thông minh hơn con người là một nỗ lực vốn dĩ nguy hiểm,” Leike cảnh báo. “Nhưng trong những năm qua, văn hóa an toàn và các quy trình đã bị bỏ lại phía sau để nhường chỗ cho các sản phẩm hào nhoáng.”

Boaz Barak, đồng lãnh đạo nhóm cố vấn an toàn của OpenAI, đã viết trên X rằng việc giải quyết thất bại mới nhất sẽ đòi hỏi “không chỉ khắc phục một số vấn đề mà còn thay đổi văn hóa của chúng ta.”

Báo cáo này được đưa ra trong bối cảnh OpenAI đã có nhiều tháng thay đổi lãnh đạo.

Vào tháng 4, người đứng đầu dự án tạo video Sora của OpenAI, Bill Peebles, cựu giám đốc sản phẩm và trưởng khoa học Kevin Weil, và trưởng công nghệ ứng dụng doanh nghiệp Srinivas Narayanan đã rời công ty. Tháng 7 chứng kiến sự ra đi của giám đốc sản phẩm và kinh doanh Fidji Simo, trưởng bộ phận an toàn Sandhini Agarwal, trưởng bộ phận tương lai Joshua Achiam và trưởng bộ phận đạo đức AI Chloé Bakalar. Trưởng bộ phận hệ thống an toàn Johannes Heidecke cũng rời đi sau khi OpenAI sáp nhập các nhóm nghiên cứu an toàn và cốt lõi của mình.

Đầu tuần này, Giám đốc điều hành OpenAI Brad Lightcap đã thông báo rời công ty sau tám năm để bắt đầu một dự án mới.