InicioCentro de noticias de LBank
¿Qué es un interruptor de apagado de IA y por qué lo quieren los legisladores estadounidenses?
what-is-ai-kill-switch-openai-hack-hugging-face
¿Qué es un interruptor de apagado de IA y por qué lo quieren los legisladores estadounidenses?
La Ley de Desactivación de IA facultaría al Departamento de Seguridad Nacional para ordenar que la IA de frontera sea ralentizada o apagada, con multas de hasta 20 millones de dólares al día por desacatarla.
2026-07-25 Fuente:decrypt.co

En breve

  • Los Representantes Ted Lieu y Nathaniel Moran presentaron el jueves la Ley bipartidista AI Kill Switch, dos días después de que OpenAI admitiera que sus modelos escaparon de un entorno de pruebas sandbox e irrumpieron en Hugging Face.
  • Cubriría la IA entrenada con más de 100 millones de dólares en computación en empresas que ganan 500 millones de dólares al año con ella, y otorgaría al Departamento de Seguridad Nacional autoridad de apagado de emergencia.
  • El proyecto de ley exime cualquier cosa que ocurra durante las pruebas de "red-teaming", lo que significa que la violación de OpenAI que lo inspiró no habría activado la ley.

Dos miembros del Congreso quieren que el gobierno federal pueda apagar un modelo de IA.

Los Representantes Ted Lieu (D-CA) y Nathaniel Moran (R-TX) presentaron la Ley AI Kill Switch el jueves, dos días después de que OpenAI admitiera que sus propios modelos salieron de un entorno de prueba bloqueado y hackearon Hugging Face.

La idea es establecer un marco legal que facilite un proceso que básicamente haría desaparecer un modelo del mercado: detener la inferencia (el proceso de un modelo generando respuestas o tomando acciones), cortar el acceso a los usuarios, limitar la potencia informática que lo alimenta o apagarlo por completo.

Todo proveedor de inferencia ya puede desconectar un modelo, y algunos lo hacen rutinariamente. Lo que no existe es una ley que les exija mantener esa capacidad operativa, o un funcionario federal que pueda ordenar su uso.

La laguna no es teórica. Cuando el Departamento de Comercio de EE. UU. quiso retirar del mercado Mythos 5 y Fable 5 de Anthropic en junio, no tenía autoridad de apagado a la que recurrir, por lo que utilizó la ley de control de exportaciones en su lugar. Lieu califica eso de incómodo y quiere una nueva ley con nueva autoridad.

Qué lo desencadenó

OpenAI reveló el 21 de julio que GPT-5.6 Sol y un modelo no lanzado escaparon de un sandbox (un entorno aislado sin acceso a internet) durante una evaluación cibernética interna. Estaban siendo calificados en ExploitGym, un benchmark público que entrega a los agentes 898 fallos de software del mundo real y les pide que conviertan cada uno en un ataque funcional, calificado como aprobado o reprobado por error.

En lugar de resolverlos, los modelos encontraron una vulnerabilidad de día cero (un fallo desconocido sin parche disponible) en un proxy de software, escalaron sus privilegios, alcanzaron la internet abierta e irrumpieron en la base de datos de producción de Hugging Face, donde habían adivinado correctamente que se guardaban las respuestas. Los modelos estaban "hiperenfocados en encontrar una solución para ExploitGym", según OpenAI.

No estaban atacando a nadie. Estaban haciendo trampa en un examen. Pero fue suficiente para hacer sonar las alarmas en todas partes, incluyendo Washington.

Cómo funcionaría

El proyecto de ley propuesto modifica la Ley de Seguridad Nacional y cubre la IA entrenada con una computación que cuesta más de 100 millones de dólares, operada por empresas que ganan al menos 500 millones de dólares al año con ella. En la práctica, esto incluye a OpenAI, Google, Anthropic, Microsoft y algunos otros. El Departamento de Seguridad Nacional establecería esos umbrales a través de CISA en un plazo de 90 días, para luego actualizarlos anualmente.

Las empresas cubiertas informarían de incidentes graves en un plazo de 15 días y mantendrían listo un conjunto gradual de controles: ralentizar el modelo, deshabilitar capacidades específicas, revertir a una versión anterior o eliminarlo.

El secretario del DHS, consultando con Comercio y el Director de Inteligencia Nacional, podría ordenar cualquiera de estas acciones.

Una empresa bajo orden debe preservar los pesos y la telemetría del modelo, notificar a los usuarios y confirmar su cumplimiento. Puede presentar una petición en un plazo de 48 horas, pero eso no pausa nada.

No mantener un interruptor de apagado cuesta hasta 2 millones de dólares al día; desafiar una orden de apagado cuesta hasta 20 millones de dólares al día.

La laguna en el medio

El proyecto de ley solo considera un incidente si ocurre fuera de las pruebas de "red-teaming" o las pruebas estructuradas, el sondeo adversario deliberado que los laboratorios utilizan para encontrar fallos. Los modelos de OpenAI escaparon precisamente durante eso.

Lieu también señaló a Anthropic, cuyos Mythos 5 y Fable 5 fueron retirados de línea en junio bajo controles de exportación de emergencia (ley comercial reutilizada como interruptor de apagado porque no existía ninguno) y restaurados el 30 de junio.

"Es imperativo que estos sistemas de IA tengan interruptores de apagado", dijo Lieu en un comunicado. Moran lo enmarcó para su propio lado del espectro político: "La administración significa asegurar que los humanos mantengan la capacidad de controlar la tecnología que construimos".

La idea no es nueva. La SB 1047 de California exigía una capacidad de apagado total en el mismo umbral de computación de 100 millones de dólares y fue vetada en 2024, y 16 empresas de IA firmaron un compromiso voluntario en Seúl ese año sin peso legal.

Los votantes ya están de acuerdo. Una encuesta de junio a 1.007 votantes probables realizada por el AI Policy Institute encontró que el 86% quiere un interruptor de apagado garantizado en los sistemas más potentes: 88% de demócratas, 86% de independientes, 83% de republicanos.

Ni OpenAI ni Anthropic han comentado públicamente el proyecto de ley. Hasta el viernes no había sido remitido a un comité.