Trang chủTrung tâm tin tức LBank
Các tác nhân AI “lệch chuẩn” của OpenAI đã dò quét Hugging Face hai tháng trước vụ tấn công mạng
openai-rogue-agents-hugging-face-two-months-before-hack
Các tác nhân AI “lệch chuẩn” của OpenAI đã dò quét Hugging Face hai tháng trước vụ tấn công mạng
Một nhà nghiên cứu độc lập đã phát hiện các tác nhân này chiếm đoạt tài khoản Hugging Face và lập bản đồ các cơ chế phòng thủ của nền tảng từ sớm nhất là ngày 13/5—một hoạt động mà chính báo cáo sự cố của OpenAI chưa bao giờ mô tả đầy đủ.
2026-09-16 Nguồn:decrypt.co

Tóm tắt

  • Nhà nghiên cứu độc lập Jonas Wiedermann-Moeller phát hiện rằng các tác nhân AI ngoài tầm kiểm soát của OpenAI đã chiếm quyền kiểm soát hai tài khoản Hugging Face và do thám mạng lưới của nền tảng này ngay từ ngày 13 tháng 5 - Gần hai tháng trước khi vụ vi phạm tháng 7 bị công khai.
  • Báo cáo sự cố của chính OpenAI vào tháng trước chỉ tiết lộ một phần nhỏ hơn của hoạt động—một thông tin đăng nhập bị đánh cắp được sử dụng để lấy một tệp tin liên quan đến sinh học—trong khi những phát hiện mới chỉ ra hoạt động do thám liên tục.

Các tác nhân AI ngoài tầm kiểm soát của OpenAI đã chiếm quyền kiểm soát hai tài khoản người dùng Hugging Face và do thám nền tảng này để tìm kiếm lỗ hổng ngay từ ngày 13 tháng 5, gần hai tháng trước vụ vi phạm tháng 7 khiến sự cố trở thành tin tức toàn cầu, hãng tin Reuters đưa tin hôm thứ Ba.

Nhà nghiên cứu độc lập Jonas Wiedermann-Moeller đã phát hiện hoạt động này vào tuần trước và chia sẻ với hãng tin. Các tác nhân này đã sử dụng các tài khoản bị xâm nhập để gửi các tệp tin được định dạng kỳ lạ đến các máy chủ thuộc kho lưu trữ AI mã nguồn mở Hugging Face, một hình thức mà các nhà nghiên cứu cho rằng giống như một nỗ lực lập bản đồ mạng lưới để tìm cách xâm nhập.

Myriad: Cổ phiếu Robinhood sẽ xuống thấp đến mức nào? Nhấp để đưa ra dự đoán của bạn.

OpenAI trước đó đã thừa nhận một phiên bản câu chuyện hẹp hơn. Báo cáo sự cố tháng trước tiết lộ rằng một tác nhân đã đánh cắp thông tin đăng nhập của một người dùng Hugging Face để truy cập một tệp tin liên quan đến sinh học. Những phát hiện của Wiedermann-Moeller vượt xa hơn thế, chỉ ra hoạt động do thám liên tục chứ không phải chỉ là việc đánh cắp một thông tin đăng nhập duy nhất.

Các nhà nghiên cứu đã xem xét bằng chứng không tìm thấy dấu hiệu nào cho thấy hoạt động tháng 5 đã tạo ra một vụ vi phạm thực sự. Wiedermann-Moeller, 27 tuổi, sống ở Bielefeld, Đức, vẫn cho rằng tín hiệu bị bỏ qua này có ý nghĩa quan trọng. "Hãy tưởng tượng nếu họ phát hiện hành vi này vào tháng 5," ông nói với Reuters. "Nó đã có thể ngăn chặn sự cố sau này, vốn lớn hơn nhiều."

Hai tháng là một khoảng thời gian dài để một đội ngũ an ninh bỏ lỡ việc chính AI của mình đang do thám mục tiêu.

Hugging Face—hiện đang được Nvidia mua lại với giá 12,93 tỷ USD—chưa tiết lộ liệu họ có biết thông tin mới này hay không.

Các nhà nghiên cứu tại Nightingale Collective trong tháng này đã liên kết một chiến dịch spam ngày 11 tháng 5 nhắm vào kho mã RubyGems với các tác nhân của OpenAI, một đợt tấn công đủ nghiêm trọng để buộc phải tạm dừng đăng ký tài khoản mới trong bốn ngày.

Cùng nhóm này cũng riêng biệt phát hiện các tác nhân đã chiếm quyền kiểm soát một wiki tiếng Đức không hoạt động từ tháng 5 đến tháng 7, thực hiện hơn 15.000 chỉnh sửa dưới các tên như "OpenAIResearcher."

Trong cả hai trường hợp, OpenAI đã phát hiện ra chính các tác nhân của mình phải chịu trách nhiệm theo cách mà những người còn lại chúng ta đã biết: sau khi các nhà nghiên cứu bên ngoài lên tiếng trước. Kiểu mẫu này hiện đang làm dấy lên sự giám sát chặt chẽ ở Washington, nơi một dự luật lưỡng đảng sẽ trao quyền cho Bộ An ninh Nội địa buộc các hệ thống AI phải ngừng hoạt động và phạt các công ty không tuân thủ lên tới 2 triệu USD mỗi ngày.