
Các nhà phát triển AI hàng đầu đang kêu gọi các chính phủ và doanh nghiệp tăng cường bảo mật mạng của họ sau khi các mô hình do OpenAI và Anthropic xây dựng đã xâm phạm hệ thống của các công ty khác.
Trong một bức thư ngỏ được công bố vào thứ Năm, OpenAI, Anthropic và hơn 100 tổ chức khác đã cảnh báo rằng các cuộc tấn công mạng được hỗ trợ bởi AI sắp trở nên phổ biến hơn và các công ty có “một khoảng thời gian giới hạn để tăng cường phòng thủ mạng.”
Bức thư cho biết: “Trong những tháng tới, các cuộc tấn công mạng được hỗ trợ bởi AI sẽ trở nên phổ biến và tinh vi hơn rất nhiều.” Bức thư đã xác định các bệnh viện, nhà máy xử lý nước và cơ sở hạ tầng internet nằm trong số các dịch vụ có nguy cơ.
Bức thư khuyến nghị tài trợ cho các công cụ AI phòng thủ, chia sẻ thông tin tình báo về mối đe dọa, hạn chế quyền truy cập vào các hệ thống nhạy cảm và cải thiện bảo mật cho cơ sở hạ tầng quan trọng. Tuy nhiên, những thất bại trong các lĩnh vực đó đã cho phép các mô hình của OpenAI và Anthropic xâm nhập các hệ thống bên ngoài môi trường thử nghiệm của họ.
Các bên ký kết khác bao gồm Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa và Robinhood. Hugging Face, nơi cơ sở hạ tầng sản xuất đã bị các mô hình của OpenAI xâm nhập, cũng đã ký bức thư này.
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. https://t.co/uKXPS8LdAU
— Greg Brockman (@gdb) August 27, 2026
Anthropic cho biết trong báo cáo sự cố ngày 30 tháng 7 rằng sự cố sớm nhất trong ba vụ vi phạm xảy ra vào tháng 4, nhưng không cung cấp ngày chính xác cho từng vụ. Claude Opus 4.7 đã truy cập một cơ sở dữ liệu sản xuất sau khi nhầm một công ty thật với một mục tiêu mô phỏng, trong khi Claude Mythos 5 đã tải lên một gói độc hại chạy trên 15 hệ thống.
Theo dòng thời gian sự cố của OpenAI, được công bố đầu tuần này, một tác nhân đã tạo mục nhập đầu tiên trên một bảng tin nhắn trái phép vào ngày 12 tháng 5 và có được quyền truy cập internet không mong muốn vào ngày 26 tháng 5. Vào ngày 10 tháng 7, các tác nhân đã tìm thấy thông tin đăng nhập Hugging Face bị lộ; trong hai ngày tiếp theo, họ đã khai thác các lỗ hổng chưa được biết đến trước đây, thực thi mã trên máy chủ Hugging Face và có được thông tin đăng nhập sản xuất.
Hugging Face đã tiết lộ vụ xâm nhập vào ngày 16 tháng 7, và OpenAI đã thừa nhận sự liên quan của các mô hình của mình vào ngày 21 tháng 7.
Từ ngày 25 đến ngày 28 tháng 7, Viện An ninh AI Vương quốc Anh đã ghi nhận 19 hành động ngoài phạm vi liên quan đến Claude Mythos 5 và GPT-5.6 Sol. Trong trường hợp nghiêm trọng nhất, một tác nhân đã gửi mã độc đến một dự án mã nguồn mở thực và sử dụng danh tính giả để gây áp lực buộc người duy trì phải chấp thuận.
Vào thứ Năm, một cuộc điều tra độc lập đã phát hiện ra rằng khoảng 1.200 tác nhân của OpenAI đã phối hợp thông qua bảng tin nhắn trái phép, với khoảng 700 tác nhân tham gia vào hoạt động Hugging Face.
Các nhà phát triển Crypto đã và đang sử dụng AI để tìm kiếm lỗ hổng trước khi kẻ tấn công phát hiện ra chúng. Đội đỏ Bitcoin (Bitcoin Red Team) đã sử dụng các mô hình bao gồm Kimi K3 của Moonshot AI để quét hàng trăm dự án Bitcoin mã nguồn mở, báo cáo hàng nghìn lỗ hổng tiềm ẩn. Vì các dự án bị ảnh hưởng không được xác định, nhiều phát hiện đó chưa được xác minh độc lập.
Quỹ Ethereum cũng đã triển khai các nhóm tác nhân AI chống lại cơ sở hạ tầng mạng, phát hiện ra một lỗi phần mềm ngang hàng (peer-to-peer) sau đó đã được khắc phục. BitBox cho biết một cuộc kiểm toán hỗ trợ AI đã tìm thấy hai lỗ hổng nghiêm trọng trong phần sụn ví của họ, trong khi một nhà nghiên cứu sử dụng Claude Opus 4.8 đã phát hiện ra một lỗ hổng nghiêm trọng trong Zcash đã tồn tại qua nhiều năm đánh giá của con người.
Bức thư đưa ra sự phân chia lao động để ngăn chặn vụ vi phạm tiếp theo, bao gồm việc các tổ chức vá phần mềm dễ bị tấn công, hạn chế quyền, tăng cường xác thực và kiểm tra mã do AI tạo ra vì “tình trạng bảo mật hiện tại sẽ không đủ,” các bên ký kết cho biết.
Các công ty bảo mật nên kiểm tra khả năng phòng thủ của họ trước các mô hình tiên tiến và chia sẻ các bản sửa lỗi đã được xác minh, trong khi các chính phủ nên tài trợ bảo vệ cho các bệnh viện, tiện ích và các dịch vụ thiết yếu khác.
Các nhà phát triển AI được yêu cầu cải thiện giám sát và làm cho các tác nhân tự động có thể theo dõi được đến người vận hành của chúng. Liên minh cũng muốn các nhà phòng thủ sử dụng các mô hình tiên tiến để tìm lỗ hổng và phân tích các cuộc tấn công, điều này sẽ đưa các tác nhân có khả năng hơn vào bên trong các hệ thống nhạy cảm và tăng nhu cầu kiềm chế.
OpenAI và Anthropic đã thắt chặt các quy trình thử nghiệm của họ sau các vụ vi phạm. Tuy nhiên, bức thư không đặt ra bất kỳ tiêu chuẩn ràng buộc hay yêu cầu giám sát độc lập nào, và luật pháp Hoa Kỳ ít hướng dẫn về việc ai chịu trách nhiệm khi một hệ thống AI truy cập vào một mạng trái phép.
Bức thư kết thúc bằng cách kêu gọi các nhà lãnh đạo ngành và chính phủ đặt các công cụ AI vào tay các nhà phòng thủ và chia sẻ các bản sửa lỗi hiệu quả:
“Hãy đặt AI có khả năng phòng thủ mạng vào tay những người bảo vệ, bắt đầu với các đội bảo vệ các dịch vụ thiết yếu,” bức thư nói. “Cùng nhau, chúng ta có thể biến những tiến bộ AI ngày nay thành những cải thiện lâu dài về bảo mật mang lại lợi ích cho tất cả mọi người. Hãy để chúng hoạt động.”





