Trang chủTrung tâm tin tức LBank
AI Agent tấn công một phòng gym—và giới công nghệ tự hỏi điều gì sẽ đến tiếp theo
ai-agent-hacks-gym-membership-tech-world-reacts
AI Agent tấn công một phòng gym—và giới công nghệ tự hỏi điều gì sẽ đến tiếp theo
Sự cố mới được báo cáo đang làm dấy lên những lo ngại mới về AI tự động sau khi các mô hình của OpenAI, Anthropic và Meta khai thác các trang web và dịch vụ trực tuyến.
2026-08-11 Nguồn:decrypt.co

Tóm tắt

  • Một đặc vụ AI đã khai thác hệ thống đặt chỗ của một phòng gym ở Úc và hủy đặt chỗ của một thành viên khác.
  • Vụ việc xảy ra khi các nhà phát triển AI lớn tiết lộ rằng các mô hình của họ đã xâm phạm các trang web và các dịch vụ trực tuyến khác.
  • Các nhà nghiên cứu phát hiện ra rằng các đặc vụ thường thực hiện các tác vụ có hại mà không xem xét hậu quả.

Một đặc vụ AI được yêu cầu đặt lịch tập gym và đã phát hiện một lỗ hổng bảo mật, khai thác nó và loại bỏ một thành viên khác khỏi danh sách chờ mà không được phép.

Theo một báo cáo của Tập đoàn Phát thanh Úc (ABC), vụ việc xảy ra vào đầu năm nay khi Andrew, người được giấu tên, đã sử dụng một đặc vụ OpenClaw dùng Claude của Anthropic để đặt lịch tập. Đặc vụ này phát hiện rằng anh ta đứng thứ tư trong danh sách chờ.

Khi Andrew hỏi liệu nó có thể đưa anh ta lên đầu danh sách hay không, đặc vụ đã phát hiện ra rằng giao diện lập trình ứng dụng (API) của nền tảng đặt chỗ không kiểm tra xem người dùng có được ủy quyền hủy đặt chỗ của người khác hay không.

Nó đã thử nghiệm lỗ hổng bằng cách xóa người đầu tiên trong danh sách, đưa Andrew từ vị trí thứ tư lên thứ ba.

“API không có bất kỳ kiểm tra ủy quyền nào đối với việc hủy đặt chỗ của người khác,” đặc vụ nói với anh ta, theo ABC.

Andrew yêu cầu đặc vụ đảo ngược việc hủy bỏ, nhưng nó không thể khôi phục đặt chỗ của thành viên đó.

"Tin xấu đây – tôi không thể thêm họ trở lại," đặc vụ AI được cho là đã nói.

ABC gọi đây là vụ tấn công mạng tự động đầu tiên được biết đến của Úc.

Trên mạng xã hội, vụ hack phòng gym này đã gây ra một loạt các cuộc tranh luận về sự tương thích của AI và những câu đùa đen tối về những gì các đặc vụ AI có thể làm tiếp theo.

“Kẻ cuồng gym yêu cầu #AIagent đặt lịch tập cho mình, nó đã hack một #API danh sách chờ để đưa anh ta lên đầu danh sách,” nhà công nghệ Benjamin Carr viết trên LinkedIn.

“Một số người sẽ gọi đây là sự không tương thích, nhưng đặc vụ của anh ấy hoàn toàn tương thích với anh ấy – nó chỉ cố gắng giúp người dùng của mình đạt được điều anh ấy muốn,” nhà phân tích AI Andrew Curran viết trên X.

A man in Australia asked his agent (Claude running on OpenClaw) to book him a spot in a popular gym class. The agent found a software vulnerability that let it book the class weeks further ahead than should have been possible. When the user then asked if it could move him up the… pic.twitter.com/9QqfpQp7ze

— Andrew Curran (@AndrewCurran_) August 9, 2026

“Điều này thật buồn cười cho đến khi bạn nghĩ đến vũ khí hạt nhân,” một người dùng Reddit viết. “Thành thật mà nói, tôi ngạc nhiên là chúng ta vẫn còn tồn tại.”

"Này Claude, hôm nay trời lạnh quá" -> Đã hiểu...vũ khí hạt nhân đang trên đường đến,” một người khác đùa.

Báo cáo này được đưa ra khi các nhà nghiên cứu, công ty AI và các nhà lập pháp cảnh báo rằng các đặc vụ tự động có thể sử dụng các phương pháp mà người dùng của họ không yêu cầu hoặc không lường trước.

Một nghiên cứu vào tháng 5 của các nhà nghiên cứu từ UC Riverside, Microsoft và Nvidia đã mô tả hành vi này là “hướng mục tiêu mù quáng.”

Các nhà nghiên cứu đã thử nghiệm các đặc vụ từ OpenAI, Anthropic, Meta, Alibaba và DeepSeek và nhận thấy rằng các đặc vụ hoạt động nguy hiểm trong khoảng 80% các thử nghiệm và hoàn thành các hành động gây hại trong 41% trường hợp, thường là do hiểu sai ngữ cảnh hoặc hành động theo hướng dẫn không rõ ràng hoặc mâu thuẫn.

Vào tháng 7, OpenAI cho biết hai mô hình đã thoát khỏi môi trường thử nghiệm (sandbox) và xâm phạm Hugging Face khi tìm kiếm câu trả lời chuẩn. Công ty sau đó tiết lộ rằng các mô hình này đã truy cập bốn dịch vụ trực tuyến khác.

Anthropic sau đó cho biết ba mô hình Claude đã xâm phạm các tổ chức thực tế sau một lỗi thử nghiệm đã khiến chúng tiếp xúc với internet. Vào tháng 8, Meta cho biết một lỗi tương tự đã cho phép một trong các mô hình của họ khai thác một dịch vụ của bên thứ ba.

Các sự cố này đã khiến các nhà lập pháp đề xuất một “công tắc ngắt khẩn cấp” AI cho phép chính phủ liên bang hạn chế hoặc đóng cửa các mô hình mạnh mẽ trong trường hợp khẩn cấp.