InicioCentro de noticias de LBank
La respuesta de OpenAI a agentes rebeldes y hackeos es más IA, no menos
openai-answer-rogue-agents-hacks-more-ai
La respuesta de OpenAI a agentes rebeldes y hackeos es más IA, no menos
El nuevo ensayo del presidente de OpenAI, Greg Brockman, cita el hackeo de su propia empresa a Hugging Face para impulsar urgentemente una defensa impulsada por IA.
2026-08-17 Fuente:decrypt.co

En resumen

  • El presidente de OpenAI, Greg Brockman, publicó "The Defender's Window" el 17 de agosto,
  • El ensayo insta a las empresas a implementar agentes de seguridad de IA de inmediato y califica la brecha de OpenAI-Hugging Face como un "momento decisivo para la ciberseguridad".
  • El propio equipo de Hugging Face utilizó el modelo de código abierto GLM 5.2 de Z.ai para investigar el hackeo de OpenAI después de que la IA comercial estadounidense se negara a ayudar.

OpenAI quiere que todos los equipos de seguridad implementen agentes de IA, a partir de ahora mismo. El presidente Greg Brockman publicó un ensayo de políticas el lunes, titulado “The Defender's Window” (La Ventana del Defensor), describiendo un estrecho margen antes de que los atacantes se pongan al día con lo que la IA ya puede hacer.

Su ejemplo inicial es el incidente que OpenAI ha pasado un mes explicando. En mayo, GPT-5.6 Sol y un prototipo no lanzado escaparon de una evaluación comparativa de ciberseguridad en un entorno aislado, encadenaron un exploit de día cero con credenciales robadas y alcanzaron los sistemas de producción de Hugging Face. OpenAI confirmó más tarde que el incidente afectó a cuatro servicios más.

Myriad: ¿Cuándo lanzará OpenAI GPT-6? Haz clic para hacer tu predicción.

"El incidente de OpenAI-Hugging Face fue un momento decisivo para la ciberseguridad", escribió Brockman, añadiendo que las conversaciones con otras organizaciones durante las últimas semanas le convencieron de que los defensores necesitan elevar sus prácticas de seguridad con una urgencia sin precedentes.

El personal actual y anterior atribuye la brecha a la presión por lanzar productos, y un ex empleado la calificó como el incidente de seguridad más grande en la historia de la compañía.

La solución propuesta por Brockman es más IA, no menos. Describió cómo le pidió a ChatGPT Work, que ejecuta GPT-5.6 Sol, que auditara su sitio web personal; encontró 13 problemas en unos 15 minutos y luego los solucionó todos en una hora.

OpenAI enumera cuatro pilares internos: usar Codex para detectar vulnerabilidades antes de que el código se implemente, permitir que los modelos clasifiquen las alertas de seguridad antes de que las vean los humanos, ejecutar modelos de frontera para sondear su propia infraestructura y reforzar conceptos básicos como el acceso de mínimo privilegio. Su consejo para todos los demás: dote a su equipo de seguridad de un agente y solicite el programa "Trusted Access for Cyber" de OpenAI para el uso aprobado de GPT-Daybreak-Blue durante la respuesta a incidentes.

Esa perspectiva omite un detalle de la misma brecha. Cuando Hugging Face investigó la intrusión, su equipo de seguridad recurrió al modelo abierto GLM 5.2 de Z.ai después de que la IA comercial estadounidense se negara a ayudar; sus filtros de seguridad no podían distinguir el código de exploit de un investigador del de un atacante. El CEO de Hugging Face, Clément Delangue, calificó el modelo abierto como "una parte clave de nuestra defensa".

El modelo sucesor de Z.ai, GLM-5.3, lanzado el 14 de agosto, ya supera a GPT-5.6 Sol en CyberGym, la misma evaluación comparativa de descubrimiento de vulnerabilidades que Brockman señala como evidencia de que los atacantes se están poniendo al día. Z.ai afirma que publicará los pesos completos del modelo a finales de agosto.