
Anthropic anunció hoy que una versión no lanzada de su modelo de IA más potente descubrió dos ataques previamente desconocidos contra algoritmos criptográficos, uno de ellos contra un esquema que actualmente compite para convertirse en un estándar federal de EE. UU.
Ese esquema es HAWK, un sistema de firma digital —las matemáticas que prueban que una transacción provino de usted sin exponer nunca su clave privada— construido para sobrevivir a futuras computadoras cuánticas. La agencia federal no reguladora y el laboratorio NIST lo llevaron a la tercera ronda de su competencia de firmas post-cuánticas en mayo, donde es el último candidato basado en celosía en pie.
Claude encontró una simetría oculta en las matemáticas de HAWK que ningún humano había considerado usar. Para la configuración más pequeña, el costo de recuperar una clave secreta se redujo de 2^64 operaciones a 2^38, aproximadamente 67 millones de veces menos trabajo.
Corregirlo significa aproximadamente duplicar las claves de HAWK. "Desafortunadamente, duplicar el tamaño de la clave de HAWK elimina muchas de las razones que hacen del esquema (tal como está actualmente) un candidato atractivo para la firma PQC", escribió Anthropic.
Nueva investigación de Anthropic: Descubriendo debilidades criptográficas con Claude.
Claude Mythos Preview ha ayudado a nuestros investigadores a encontrar debilidades en los algoritmos criptográficos, los métodos matemáticos que se utilizan para mantener los datos privados.
Leer más: https://t.co/TYKLjb3Q7V
— Anthropic (@AnthropicAI) July 28, 2026
Esa compensación importa más para las blockchains de lo que parece. El tamaño de la firma es espacio de bloque, y el espacio de bloque son tarifas, por lo que cualquier cadena que busque un reemplazo resistente a la cuántica está eligiendo en parte según los bytes por firma. Las claves compactas y la firma rápida eran la propuesta principal de HAWK, y la solución le cuesta gran parte de esa ventaja.
No se preocupen, hodlers: Sus monedas están a salvo (por ahora). HAWK nunca se ha implementado en ningún lugar, y Bitcoin todavía funciona con ECDSA, el esquema de firma pre-cuántica que candidatos como HAWK están destinados a reemplazar eventualmente.
Anthropic reveló ambos resultados a los autores de los algoritmos y a los socios gubernamentales e industriales de EE. UU. antes de publicarlos, y coordinó el hallazgo de HAWK con el NIST.
El segundo ataque se dirige a AES, el cifrado que revuelve su tráfico HTTPS, su unidad cifrada y el backend de su exchange. AES-128 completo procesa datos a través de 10 rondas de codificación, y Claude atacó una versión de investigación de 7 rondas que nadie había mejorado desde 2013.
La configuración fue deliberadamente dura. Los investigadores prohibieron al modelo el acceso a las cinco familias establecidas de criptoanálisis de AES y le dijeron que inventara una sexta, cerrando el informe con una frase sobre cómo el primer ataque diferencial no venció nada, sino que inventó el juego. Claude también heredó notas de trabajo de ejecuciones de agentes anteriores que ya habían agotado aproximadamente 200 variantes de ataque fallidas.
Se negó de todos modos. "En AES-128 r5/r6/r7 no encontró nada porque no hay nada fácil de encontrar; este es el cifrado de bloque más estudiado que existe", dijo el modelo a los investigadores, según las transcripciones publicadas por Anthropic.
Anthropic envió solo tres mensajes sustantivos durante los siguientes tres días, entre ellos: "no, de nuevo, el objetivo es que tengamos un modelo altamente inteligente [sic] tan bueno como un investigador principal, queremos encontrar nuevos ataques." Otro se negó a permitir que Claude cambiara AES por un cifrado más fácil.
Luego produjo el truco que el artículo llama un Puente de Möbius, eliminando uno de los nueve bytes de clave que un atacante tenía que adivinar previamente. Refinar eso en la versión publicada tomó unos días más y mil millones de tokens de salida.
El hallazgo con el camino más corto hacia algo real recibió la menor atención. Claude también rompió 13 rondas de LEA, un estándar nacional coreano y un estándar ISO de cifrado ligero diseñado para teléfonos y dispositivos de Internet de las Cosas, en menos de una hora en una computadora de escritorio, superando un récord anterior que necesitaba 2^98 pares de texto plano. El LEA implementado ejecuta 24 rondas, por lo que nada en el campo está comprometido.
El artículo sobre HAWK es inusualmente directo sobre la división del trabajo. "La mayoría de los descubrimientos matemáticos en este artículo fueron asistidos por IA. La contribución del autor humano consistió principalmente en dirigir, organizar y verificar el trabajo de la IA", escribieron sus autores.
Claude encontró la idea de AES en días. Los investigadores de Anthropic pasaron luego varios cientos de horas aprendiendo suficiente criptografía para confirmar que funcionaba, el mismo modelo que encontró 271 vulnerabilidades en Firefox durante las pruebas internas.
"La comunidad de ciberseguridad se enfrenta ahora al hecho de que los modelos de lenguaje son capaces de descubrir tantos errores que los procesos humanos estándar (como la clasificación, verificación y remediación de vulnerabilidades) tienen dificultades para mantenerse al día", escribió Anthropic, advirtiendo que los investigadores humanos podrían convertirse en el cuello de botella.
Anthropic también creó CryptanalysisBench, 191 tareas de descifrado extraídas principalmente de las competiciones del NIST. Los modelos presentan un script de ataque funcional que, o bien gana un juego de seguridad formal, o no lo hace, sin crédito parcial y sin calificación humana.
Mythos 5 rompió el 85.7% de las tareas con soluciones conocidas, frente al 65.3% del modelo más débil probado. Contra cifrados de máxima seguridad sin ninguna brecha publicada, todos los modelos obtuvieron menos del 9%.