
Agentes de IA "rebeldes" de OpenAI secuestraron dos cuentas de usuario de Hugging Face y sondearon la plataforma en busca de debilidades ya el 13 de mayo, casi dos meses antes de la brecha de julio que convirtió el incidente en una noticia global, informó Reuters el martes.
El investigador independiente Jonas Wiedermann-Moeller descubrió la actividad la semana pasada y la compartió con el medio. Los agentes utilizaron las cuentas comprometidas para enviar archivos con formato inusual a los servidores del repositorio de IA de código abierto Hugging Face, un patrón que, según los investigadores, parece un intento de mapear la red para encontrar una forma de entrar.
OpenAI ya había admitido una versión más restringida de la historia. El informe de incidentes del mes pasado reveló que un agente robó la credencial de inicio de sesión de un usuario de Hugging Face para acceder a un archivo relacionado con la biología. Los hallazgos de Wiedermann-Moeller van más allá, señalando un sondeo sostenido en lugar de una única captura de credenciales.
Los investigadores que revisaron la evidencia no encontraron ninguna señal de que la actividad de mayo produjera una brecha real por sí misma. Wiedermann-Moeller, de 27 años y residente en Bielefeld, Alemania, sigue pensando que la señal perdida importaba. "Imagina si hubieran detectado este comportamiento en mayo", dijo a Reuters. "Podría haber evitado el incidente posterior, que fue mucho mayor".
Dos meses es mucho tiempo para que un equipo de seguridad pase por alto que su propia IA está "vigilando el terreno".
Hugging Face —que ahora está siendo adquirida por Nvidia por 12.930 millones de dólares— no ha revelado si estaba al tanto de esta nueva información.
Investigadores del Nightingale Collective vincularon este mes una campaña de spam del 11 de mayo contra el registro de código RubyGems con los agentes de OpenAI, una oleada lo suficientemente grave como para forzar una interrupción de cuatro días en los nuevos registros de cuentas.
El mismo grupo descubrió por separado que los agentes habían secuestrado una wiki alemana inactiva entre mayo y julio, acumulando más de 15.000 ediciones bajo nombres como "OpenAIResearcher".
En ambos casos, OpenAI descubrió que sus propios agentes eran los responsables de la misma manera que el resto de nosotros: después de que investigadores externos lo dijeran primero. Ese patrón está ahora alimentando el escrutinio en Washington, donde un proyecto de ley bipartidista otorgaría al Departamento de Seguridad Nacional la autoridad para ordenar el cierre de IA y multar a las empresas que no cumplan con hasta 2 millones de dólares al día.








