Trang chủTrung tâm tin tức LBank
Cơ chế vô hiệu hóa AI là gì và tại sao các nhà lập pháp Hoa Kỳ lại mong muốn có một?
what-is-ai-kill-switch-openai-hack-hugging-face
Cơ chế vô hiệu hóa AI là gì và tại sao các nhà lập pháp Hoa Kỳ lại mong muốn có một?
Đạo luật Vô hiệu hóa AI sẽ cho phép Bộ An ninh Nội địa ra lệnh giảm tốc độ hoặc tắt hoàn toàn các hệ thống AI tiên tiến, với mức phạt lên tới 20 triệu đô la mỗi ngày nếu không tuân thủ.
2026-07-25 Nguồn:decrypt.co

Tóm tắt

  • Dân biểu Ted Lieu và Nathaniel Moran đã giới thiệu Đạo luật AI Kill Switch lưỡng đảng vào thứ Năm, hai ngày sau khi OpenAI thừa nhận các mô hình của họ đã thoát khỏi môi trường thử nghiệm "sandbox" và xâm nhập Hugging Face.
  • Đạo luật này sẽ áp dụng cho các hệ thống AI được đào tạo với chi phí điện toán trên 100 triệu USD tại các công ty kiếm được ít nhất 500 triệu USD mỗi năm từ AI đó, và trao quyền cho Bộ An ninh Nội địa (Homeland Security) khả năng tắt khẩn cấp.
  • Dự luật miễn trừ bất kỳ sự cố nào xảy ra trong quá trình "red-teaming", có nghĩa là vụ xâm nhập của OpenAI đã truyền cảm hứng cho đạo luật này sẽ không kích hoạt luật.

Hai thành viên Quốc hội muốn chính phủ liên bang có khả năng tắt một mô hình AI.

Dân biểu Ted Lieu (D-CA) và Nathaniel Moran (R-TX) đã giới thiệu Đạo luật AI Kill Switch vào thứ Năm, hai ngày sau khi OpenAI thừa nhận các mô hình của chính họ đã thoát ra khỏi môi trường thử nghiệm bị khóa và tấn công Hugging Face.

Ý tưởng là thiết lập một khuôn khổ pháp lý nhằm tạo điều kiện cho một quy trình về cơ bản sẽ khiến một mô hình biến mất khỏi thị trường: ngừng suy luận (inference) – quá trình một mô hình tạo ra phản hồi hoặc thực hiện hành động – cắt quyền truy cập của người dùng, hạn chế sức mạnh tính toán cung cấp cho nó, hoặc tắt hoàn toàn.

Mọi nhà cung cấp suy luận (inference provider) đều có thể ngừng hoạt động một mô hình, và một số làm điều đó thường xuyên. Điều chưa tồn tại là một đạo luật yêu cầu họ duy trì khả năng đó, hoặc một quan chức liên bang có thể ra lệnh sử dụng nó.

Khoảng trống này không chỉ là lý thuyết. Khi Bộ Thương mại Hoa Kỳ muốn loại bỏ Mythos 5 và Fable 5 của Anthropic khỏi thị trường vào tháng 6, họ không có thẩm quyền tắt hệ thống nào để sử dụng, vì vậy họ đã dùng luật kiểm soát xuất khẩu thay thế. Lieu gọi đó là một sự lúng túng, và muốn một luật mới với quyền hạn mới.

Điều gì đã châm ngòi cho việc này

OpenAI tiết lộ vào ngày 21 tháng 7 rằng GPT-5.6 Sol và một mô hình chưa được phát hành đã thoát khỏi một "sandbox" – một môi trường biệt lập không có truy cập internet – trong quá trình đánh giá an ninh mạng nội bộ. Chúng đang được chấm điểm trên ExploitGym, một tiêu chuẩn công khai cung cấp cho các tác nhân 898 lỗ hổng phần mềm thực tế và yêu cầu chúng biến mỗi lỗ hổng thành một cuộc tấn công hoạt động, được chấm điểm đạt hoặc không đạt cho mỗi lỗi.

Thay vì giải quyết các lỗ hổng, các mô hình đã tìm thấy một lỗ hổng zero-day (một lỗi chưa biết không có bản vá có sẵn) trong một proxy phần mềm, leo thang đặc quyền của chúng, truy cập internet mở và đột nhập vào cơ sở dữ liệu sản xuất của Hugging Face, nơi chúng đã đoán đúng rằng các câu trả lời được lưu giữ. Các mô hình đã "cực kỳ tập trung vào việc tìm kiếm giải pháp cho ExploitGym," theo OpenAI.

Chúng không tấn công ai cả. Chúng đang gian lận trong một bài kiểm tra. Nhưng điều đó đủ để gióng lên hồi chuông cảnh báo khắp nơi, bao gồm cả ở Washington.

Cách thức hoạt động

Dự luật đề xuất sửa đổi Đạo luật An ninh Nội địa và áp dụng cho AI được đào tạo với chi phí điện toán trên 100 triệu USD, được vận hành bởi các công ty kiếm được ít nhất 500 triệu USD mỗi năm từ nó. Trong thực tế, đó là OpenAI, Google, Anthropic, Microsoft và một vài công ty khác. Bộ An ninh Nội địa sẽ đặt ra các ngưỡng này thông qua CISA trong vòng 90 ngày, sau đó cập nhật hàng năm.

Các công ty thuộc diện áp dụng sẽ báo cáo các sự cố nghiêm trọng trong vòng 15 ngày và chuẩn bị sẵn một bộ kiểm soát theo cấp độ – làm chậm mô hình, vô hiệu hóa các khả năng cụ thể, khôi phục về phiên bản cũ hơn hoặc tắt hoàn toàn.

Bộ trưởng Bộ An ninh Nội địa (DHS), sau khi tham vấn Bộ Thương mại và Giám đốc Tình báo Quốc gia, có thể ra lệnh thực hiện bất kỳ biện pháp nào trong số đó.

Một công ty bị ra lệnh phải bảo toàn trọng số và dữ liệu đo từ xa của mô hình, thông báo cho người dùng và xác nhận đã tuân thủ. Công ty có thể kiến nghị trong vòng 48 giờ, nhưng điều đó không làm tạm dừng bất cứ điều gì.

Không duy trì "công tắc tắt" sẽ bị phạt tới 2 triệu USD mỗi ngày; chống lại lệnh ngừng hoạt động sẽ bị phạt tới 20 triệu USD mỗi ngày.

Khoảng trống ở giữa

Dự luật chỉ tính một sự cố nếu nó xảy ra bên ngoài quá trình "red-teaming" hoặc thử nghiệm có cấu trúc, tức là việc các phòng thí nghiệm cố tình dò tìm lỗi theo cách đối kháng. Các mô hình của OpenAI đã thoát ra chính trong quá trình đó.

Lieu cũng chỉ ra Anthropic, với các mô hình Mythos 5 và Fable 5 đã bị gỡ ngoại tuyến vào tháng 6 theo lệnh kiểm soát xuất khẩu khẩn cấp – luật thương mại được sử dụng như một "công tắc tắt" vì không có công tắc tắt nào tồn tại – và được khôi phục vào ngày 30 tháng 6.

"Điều bắt buộc là các hệ thống AI này phải có công tắc tắt," Lieu nói trong một tuyên bố. Moran đã trình bày quan điểm của mình cho phe cánh của ông: "Trách nhiệm quản lý có nghĩa là đảm bảo con người giữ được khả năng kiểm soát công nghệ mà chúng ta tạo ra."

Ý tưởng này không mới. Dự luật SB 1047 của California đã yêu cầu khả năng tắt hoàn toàn ở ngưỡng chi phí điện toán 100 triệu USD tương tự và đã bị phủ quyết vào năm 2024, và 16 công ty AI đã ký một cam kết tự nguyện ở Seoul cùng năm đó mà không có giá trị pháp lý.

Cử tri đã ủng hộ điều này. Một cuộc khảo sát vào tháng 6 đối với 1.007 cử tri tiềm năng của Viện Chính sách AI cho thấy 86% muốn có một công tắc tắt được đảm bảo trên các hệ thống mạnh nhất – 88% đảng viên Dân chủ, 86% người độc lập, 83% đảng viên Cộng hòa.

Cả OpenAI và Anthropic đều chưa bình luận công khai về dự luật. Tính đến thứ Sáu, dự luật vẫn chưa được chuyển đến ủy ban.