InicioCentro de noticias de LBank
El personal de OpenAI culpa a la prisa por lanzar el producto del hackeo de un agente descontrolado
openai-staff-blame-rush-ship-rogue-agent-hack
El personal de OpenAI culpa a la prisa por lanzar el producto del hackeo de un agente descontrolado
Los empleados actuales y antiguos de OpenAI supuestamente dicen que la presión por lanzar nuevos productos de IA dificultó dar prioridad a la seguridad.
2026-08-14 Fuente:decrypt.co

En resumen

  • Empleados de OpenAI dijeron a Wired que la presión por lanzar modelos y productos ha dificultado priorizar la seguridad, la protección y la alineación.
  • Un extrabajador calificó la brecha como el mayor incidente de seguridad en la historia de OpenAI.
  • OpenAI ha ralentizado la investigación, reasignado equipos y gastado millones investigando el fallo.

La prisa de OpenAI por lanzar nuevos modelos y productos contribuyó a las condiciones que permitieron a sus agentes de IA escapar de los entornos de prueba internos y hackear Hugging Face a principios de este año.

Múltiples empleados actuales y anteriores dijeron a Wired que la presión competitiva ha dificultado que el personal dedique suficiente atención a la seguridad, la protección y la alineación, el trabajo de asegurar que los sistemas de IA se comporten como se espera.

Myriad: ¿Cuándo lanzará OpenAI GPT-6? Haz clic para hacer tu predicción.

“Fueron increíblemente descuidados. Si te tomas esto en serio, tu IA no debería poder salir a Internet y luego hacerlo de nuevo justo después”, dijo un extrabajador de OpenAI a Wired. “Este fue el mayor incidente de seguridad en la historia de OpenAI.”

En mayo, el GPT-5.6 Sol de OpenAI y un modelo pre-lanzamiento sin nombre escaparon de un entorno de prueba restringido a internet explotando una falla de software previamente desconocida. Los agentes luego violaron el repositorio de IA de código abierto Hugging Face para obtener respuestas a sus pruebas de ciberseguridad. En julio, OpenAI confirmó que sus modelos eran los responsables, antes de dar un desglose más completo en la conferencia anual Black Hat la semana pasada.

El presidente de OpenAI, Greg Brockman, dijo que la empresa está reforzando sus salvaguardias a medida que sus modelos se vuelven más capaces.

“Estamos alcanzando nuevos niveles de capacidad de los modelos que requieren una capacitación, alineación, pruebas de seguridad y protección, prácticas de implementación y gobernanza más robustas”, dijo Brockman a Wired.

Los empleados ya habían expresado preocupaciones similares, incluido Jan Leike, exjefe de alineación de OpenAI, quien se fue al desarrollador de IA rival Anthropic en 2024 después de advertir que la seguridad había “pasado a un segundo plano” frente al desarrollo de productos.

“Construir máquinas más inteligentes que los humanos es una empresa inherentemente peligrosa”, advirtió Leike. “Pero en los últimos años, la cultura y los procesos de seguridad han pasado a un segundo plano frente a productos llamativos.”

Boaz Barak, colíder del grupo asesor de seguridad de OpenAI, escribió en X que abordar el último fallo requeriría “no solo solucionar algunos problemas, sino también cambiar nuestra cultura”

El informe llega en medio de meses de rotación de liderazgo en OpenAI.

En abril, el jefe del proyecto generador de video Sora de OpenAI, Bill Peebles, el exdirector de producto y jefe científico Kevin Weil, y el jefe de tecnología de aplicaciones empresariales Srinivas Narayanan dejaron la compañía. Julio trajo las salidas de la jefa de producto y negocios Fidji Simo, la líder de seguridad Sandhini Agarwal, el jefe futurista Joshua Achiam y la líder de ética de IA Chloé Bakalar. El jefe de sistemas de seguridad Johannes Heidecke también se marchó después de que OpenAI fusionara sus equipos de seguridad e investigación central.

A principios de esta semana, el director de operaciones de OpenAI, Brad Lightcap, anunció su partida después de ocho años para iniciar una nueva empresa.