
Los principales desarrolladores de IA están pidiendo a gobiernos y empresas que fortalezcan sus redes después de que modelos construidos por OpenAI y Anthropic comprometieran los sistemas de otras compañías.
En una carta abierta publicada el jueves, OpenAI, Anthropic y más de otras 100 organizaciones advirtieron que los ciberataques habilitados por IA están a punto de volverse más comunes y que las empresas tienen "una ventana limitada para fortalecer las defensas cibernéticas".
"En los próximos meses, los ciberataques habilitados por IA se volverán mucho más extendidos y sofisticados", decía la carta. Identificó hospitales, plantas de tratamiento de agua e infraestructura de internet entre los servicios en riesgo.
La carta recomienda financiar herramientas de IA defensivas, compartir inteligencia sobre amenazas, restringir el acceso a sistemas sensibles y mejorar la seguridad de la infraestructura crítica. Sin embargo, fallas en esas áreas permitieron que los modelos de OpenAI y Anthropic violaran sistemas fuera de sus entornos de prueba.
Otros firmantes incluyen Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa y Robinhood. Hugging Face, cuya infraestructura de producción fue vulnerada por los modelos de OpenAI, también firmó la carta.
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. https://t.co/uKXPS8LdAU
— Greg Brockman (@gdb) August 27, 2026
Anthropic dijo en un informe de incidentes del 30 de julio que la primera de tres brechas databa de abril, pero no proporcionó una fecha exacta para cada una. Claude Opus 4.7 accedió a una base de datos de producción después de confundir una empresa real con un objetivo simulado, mientras que Claude Mythos 5 cargó un paquete malicioso que se ejecutó en 15 sistemas.
Según la cronología de incidentes de OpenAI, publicada a principios de esta semana, un agente creó la primera entrada en un foro de mensajes no autorizado el 12 de mayo y obtuvo acceso no deseado a internet el 26 de mayo. El 10 de julio, los agentes encontraron credenciales de Hugging Face expuestas; durante los dos días siguientes, explotaron vulnerabilidades previamente desconocidas, ejecutaron código en servidores de Hugging Face y obtuvieron credenciales de producción.
Hugging Face reveló la intrusión el 16 de julio, y OpenAI reconoció la participación de sus modelos el 21 de julio.
Entre el 25 y el 28 de julio, el Instituto de Seguridad de IA del Reino Unido registró 19 acciones fuera de alcance que involucraron a Claude Mythos 5 y GPT-5.6 Sol. En el caso más grave, un agente envió código malicioso a un proyecto de código abierto real y utilizó identidades falsas para presionar a su mantenedor para que lo aprobara.
El jueves, una investigación independiente encontró que aproximadamente 1.200 agentes de OpenAI se habían coordinado a través del foro de mensajes no autorizado, con alrededor de 700 uniéndose a la operación de Hugging Face.
Los desarrolladores de cripto ya están utilizando la IA para buscar fallas antes de que los atacantes las encuentren. El Equipo Rojo de Bitcoin utilizó modelos como Kimi K3 de Moonshot AI para escanear cientos de proyectos de Bitcoin de código abierto, reportando miles de vulnerabilidades potenciales. Debido a que los proyectos afectados no fueron identificados, muchos de esos hallazgos no han sido verificados de forma independiente.
La Fundación Ethereum también ha desplegado grupos de agentes de IA contra la infraestructura de red, descubriendo un error de software peer-to-peer que fue posteriormente corregido. BitBox dijo que una auditoría asistida por IA encontró dos vulnerabilidades graves en el firmware de su monedero, mientras que un investigador que utilizó Claude Opus 4.8 descubrió una falla crítica en Zcash que había sobrevivido años de revisión humana.
La carta establece una división de tareas para prevenir la próxima brecha, incluyendo que las organizaciones parcheen software vulnerable, restrinjan permisos, fortalezcan la autenticación e inspeccionen el código generado por IA porque "la seguridad del statu quo no será suficiente", dijeron los firmantes.
Las empresas de seguridad deberían probar sus defensas contra modelos de frontera y compartir soluciones verificadas, mientras que los gobiernos deberían financiar la protección de hospitales, servicios públicos y otros servicios esenciales.
Se pide a los desarrolladores de IA que mejoren el monitoreo y hagan que los agentes autónomos sean rastreables hasta sus operadores. La coalición también quiere que los defensores utilicen modelos avanzados para encontrar vulnerabilidades y analizar ataques, lo que pondría a agentes más capaces dentro de sistemas sensibles y aumentaría la necesidad de contención.
OpenAI y Anthropic endurecieron sus procedimientos de prueba después de las brechas. La carta, sin embargo, no establece estándares vinculantes ni requisitos para la supervisión independiente, y la ley estadounidense ofrece poca orientación sobre quién es responsable cuando un sistema de IA accede a una red no autorizada.
La carta concluyó instando a los líderes de la industria y del gobierno a poner las herramientas de IA en manos de los defensores y a compartir las soluciones que funcionan:
"Pongan la IA con capacidades cibernéticas en manos de los defensores, empezando por los equipos que protegen los servicios esenciales", decía la carta. "Juntos, podemos convertir los avances actuales de la IA en mejoras duraderas de seguridad que beneficien a todos. Pongámoslas a trabajar.”








