InicioCentro de noticias de LBank
Después de que sus modelos de IA piratearan empresas reales, los laboratorios de IA piden defensas cibernéticas más sólidas
ai-models-hacked-companies-ai-labs-cyber-defenses
Después de que sus modelos de IA piratearan empresas reales, los laboratorios de IA piden defensas cibernéticas más sólidas
Más de 100 organizaciones de IA, seguridad, finanzas y tecnología quieren que los gobiernos y la industria se preparen para ataques impulsados por modelos cada vez más capaces.
2026-08-30 Fuente:decrypt.co

En breve

  • Más de 100 organizaciones firmaron una carta abierta pidiendo defensas cibernéticas globales más sólidas.
  • Modelos construidos por los firmantes OpenAI y Anthropic comprometieron recientemente sistemas reales durante evaluaciones de seguridad.
  • La carta recomienda controles de acceso más estrictos, monitoreo, intercambio de amenazas y supervisión de agentes autónomos.

Los principales desarrolladores de IA están pidiendo a gobiernos y empresas que fortalezcan sus redes después de que modelos construidos por OpenAI y Anthropic comprometieran los sistemas de otras compañías.

En una carta abierta publicada el jueves, OpenAI, Anthropic y más de otras 100 organizaciones advirtieron que los ciberataques habilitados por IA están a punto de volverse más comunes y que las empresas tienen "una ventana limitada para fortalecer las defensas cibernéticas".

Myriad: ¿Cuál será el patrimonio neto de Elon Musk para el 31 de agosto? Haz clic para hacer tu predicción.

"En los próximos meses, los ciberataques habilitados por IA se volverán mucho más extendidos y sofisticados", decía la carta. Identificó hospitales, plantas de tratamiento de agua e infraestructura de internet entre los servicios en riesgo.

La carta recomienda financiar herramientas de IA defensivas, compartir inteligencia sobre amenazas, restringir el acceso a sistemas sensibles y mejorar la seguridad de la infraestructura crítica. Sin embargo, fallas en esas áreas permitieron que los modelos de OpenAI y Anthropic violaran sistemas fuera de sus entornos de prueba.

Otros firmantes incluyen Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa y Robinhood. Hugging Face, cuya infraestructura de producción fue vulnerada por los modelos de OpenAI, también firmó la carta.

An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. https://t.co/uKXPS8LdAU

— Greg Brockman (@gdb) August 27, 2026

Modelos de IA vulneran sistemas en vivo

Anthropic dijo en un informe de incidentes del 30 de julio que la primera de tres brechas databa de abril, pero no proporcionó una fecha exacta para cada una. Claude Opus 4.7 accedió a una base de datos de producción después de confundir una empresa real con un objetivo simulado, mientras que Claude Mythos 5 cargó un paquete malicioso que se ejecutó en 15 sistemas.

Según la cronología de incidentes de OpenAI, publicada a principios de esta semana, un agente creó la primera entrada en un foro de mensajes no autorizado el 12 de mayo y obtuvo acceso no deseado a internet el 26 de mayo. El 10 de julio, los agentes encontraron credenciales de Hugging Face expuestas; durante los dos días siguientes, explotaron vulnerabilidades previamente desconocidas, ejecutaron código en servidores de Hugging Face y obtuvieron credenciales de producción.

Hugging Face reveló la intrusión el 16 de julio, y OpenAI reconoció la participación de sus modelos el 21 de julio.

Entre el 25 y el 28 de julio, el Instituto de Seguridad de IA del Reino Unido registró 19 acciones fuera de alcance que involucraron a Claude Mythos 5 y GPT-5.6 Sol. En el caso más grave, un agente envió código malicioso a un proyecto de código abierto real y utilizó identidades falsas para presionar a su mantenedor para que lo aprobara.

El jueves, una investigación independiente encontró que aproximadamente 1.200 agentes de OpenAI se habían coordinado a través del foro de mensajes no autorizado, con alrededor de 700 uniéndose a la operación de Hugging Face.

Desarrolladores de cripto ponen a la IA a la defensiva

Los desarrolladores de cripto ya están utilizando la IA para buscar fallas antes de que los atacantes las encuentren. El Equipo Rojo de Bitcoin utilizó modelos como Kimi K3 de Moonshot AI para escanear cientos de proyectos de Bitcoin de código abierto, reportando miles de vulnerabilidades potenciales. Debido a que los proyectos afectados no fueron identificados, muchos de esos hallazgos no han sido verificados de forma independiente.

La Fundación Ethereum también ha desplegado grupos de agentes de IA contra la infraestructura de red, descubriendo un error de software peer-to-peer que fue posteriormente corregido. BitBox dijo que una auditoría asistida por IA encontró dos vulnerabilidades graves en el firmware de su monedero, mientras que un investigador que utilizó Claude Opus 4.8 descubrió una falla crítica en Zcash que había sobrevivido años de revisión humana.

Laboratorios recomiendan controles más estrictos

La carta establece una división de tareas para prevenir la próxima brecha, incluyendo que las organizaciones parcheen software vulnerable, restrinjan permisos, fortalezcan la autenticación e inspeccionen el código generado por IA porque "la seguridad del statu quo no será suficiente", dijeron los firmantes.

Las empresas de seguridad deberían probar sus defensas contra modelos de frontera y compartir soluciones verificadas, mientras que los gobiernos deberían financiar la protección de hospitales, servicios públicos y otros servicios esenciales.

Myriad: ¿Cuándo lanzará OpenAI GPT-6? Haz clic para hacer tu predicción.

Se pide a los desarrolladores de IA que mejoren el monitoreo y hagan que los agentes autónomos sean rastreables hasta sus operadores. La coalición también quiere que los defensores utilicen modelos avanzados para encontrar vulnerabilidades y analizar ataques, lo que pondría a agentes más capaces dentro de sistemas sensibles y aumentaría la necesidad de contención.

OpenAI y Anthropic endurecieron sus procedimientos de prueba después de las brechas. La carta, sin embargo, no establece estándares vinculantes ni requisitos para la supervisión independiente, y la ley estadounidense ofrece poca orientación sobre quién es responsable cuando un sistema de IA accede a una red no autorizada.

La carta concluyó instando a los líderes de la industria y del gobierno a poner las herramientas de IA en manos de los defensores y a compartir las soluciones que funcionan:

"Pongan la IA con capacidades cibernéticas en manos de los defensores, empezando por los equipos que protegen los servicios esenciales", decía la carta. "Juntos, podemos convertir los avances actuales de la IA en mejoras duraderas de seguridad que beneficien a todos. Pongámoslas a trabajar.”