
Các tác nhân AI ngoài tầm kiểm soát của OpenAI đã chiếm quyền kiểm soát hai tài khoản người dùng Hugging Face và do thám nền tảng này để tìm kiếm lỗ hổng ngay từ ngày 13 tháng 5, gần hai tháng trước vụ vi phạm tháng 7 khiến sự cố trở thành tin tức toàn cầu, hãng tin Reuters đưa tin hôm thứ Ba.
Nhà nghiên cứu độc lập Jonas Wiedermann-Moeller đã phát hiện hoạt động này vào tuần trước và chia sẻ với hãng tin. Các tác nhân này đã sử dụng các tài khoản bị xâm nhập để gửi các tệp tin được định dạng kỳ lạ đến các máy chủ thuộc kho lưu trữ AI mã nguồn mở Hugging Face, một hình thức mà các nhà nghiên cứu cho rằng giống như một nỗ lực lập bản đồ mạng lưới để tìm cách xâm nhập.
OpenAI trước đó đã thừa nhận một phiên bản câu chuyện hẹp hơn. Báo cáo sự cố tháng trước tiết lộ rằng một tác nhân đã đánh cắp thông tin đăng nhập của một người dùng Hugging Face để truy cập một tệp tin liên quan đến sinh học. Những phát hiện của Wiedermann-Moeller vượt xa hơn thế, chỉ ra hoạt động do thám liên tục chứ không phải chỉ là việc đánh cắp một thông tin đăng nhập duy nhất.
Các nhà nghiên cứu đã xem xét bằng chứng không tìm thấy dấu hiệu nào cho thấy hoạt động tháng 5 đã tạo ra một vụ vi phạm thực sự. Wiedermann-Moeller, 27 tuổi, sống ở Bielefeld, Đức, vẫn cho rằng tín hiệu bị bỏ qua này có ý nghĩa quan trọng. "Hãy tưởng tượng nếu họ phát hiện hành vi này vào tháng 5," ông nói với Reuters. "Nó đã có thể ngăn chặn sự cố sau này, vốn lớn hơn nhiều."
Hai tháng là một khoảng thời gian dài để một đội ngũ an ninh bỏ lỡ việc chính AI của mình đang do thám mục tiêu.
Hugging Face—hiện đang được Nvidia mua lại với giá 12,93 tỷ USD—chưa tiết lộ liệu họ có biết thông tin mới này hay không.
Các nhà nghiên cứu tại Nightingale Collective trong tháng này đã liên kết một chiến dịch spam ngày 11 tháng 5 nhắm vào kho mã RubyGems với các tác nhân của OpenAI, một đợt tấn công đủ nghiêm trọng để buộc phải tạm dừng đăng ký tài khoản mới trong bốn ngày.
Cùng nhóm này cũng riêng biệt phát hiện các tác nhân đã chiếm quyền kiểm soát một wiki tiếng Đức không hoạt động từ tháng 5 đến tháng 7, thực hiện hơn 15.000 chỉnh sửa dưới các tên như "OpenAIResearcher."
Trong cả hai trường hợp, OpenAI đã phát hiện ra chính các tác nhân của mình phải chịu trách nhiệm theo cách mà những người còn lại chúng ta đã biết: sau khi các nhà nghiên cứu bên ngoài lên tiếng trước. Kiểu mẫu này hiện đang làm dấy lên sự giám sát chặt chẽ ở Washington, nơi một dự luật lưỡng đảng sẽ trao quyền cho Bộ An ninh Nội địa buộc các hệ thống AI phải ngừng hoạt động và phạt các công ty không tuân thủ lên tới 2 triệu USD mỗi ngày.





