Descubriendo debilidades criptográficas con Claude

La afirmación de Anthropic de que su sistema “Mythos” basado en Claude encontró nuevas mejoras criptanalíticas sobre AES de rondas reducidas y sobre el esquema de firma poscuántica HAWK ha suscitado debate tanto sobre la importancia técnica como sobre el encuadre de los resultados. Los comentaristas señalan en general que los ataques no ponen en peligro la criptografía del mundo real, pero los ven como un ejemplo temprano de LLM que amplían la investigación especializada buscando en grandes espacios de soluciones, al tiempo que cuestionan la reproducibilidad, el tono promocional de la publicación y el coste de 100.000 dólares en API por resultado. El hilo también plantea preocupaciones más amplias sobre la dependencia excesiva de esquemas poscuánticos inmaduros, las desigualdades emergentes en el acceso a modelos potentes y si la “ingeniería de prompts” es una habilidad real o simplemente una especificación clara del problema.

Alcance e importancia de los resultados criptográficos

  • El trabajo sobre AES es sobre AES-128 de 7 rondas con texto plano elegido; el AES completo de 10 rondas en sistemas reales no se ve afectado.
  • La mejora respecto a ataques previos de 7 rondas se describe como marginal (unos pocos bits de seguridad) y parte de una larga cadena de ataques incrementales.
  • El resultado sobre HAWK reduce a la mitad la fortaleza efectiva de la clave de una variante simplificada de HAWK-256 mediante un automorfismo en su retícula; esto podría extenderse a HAWK-512, pero aún no es crítico en el mundo real porque HAWK no está desplegado.
  • Varios comentaristas enfatizan que se trata de la práctica criptanalítica estándar sobre modelos de rondas reducidas / texto plano elegido, no de una ruptura práctica de sistemas desplegados.

Cripto poscuántica y preocupaciones de seguridad

  • A algunos les incomoda depender únicamente de esquemas PQC y prefieren modos híbridos (clásico+PQC); otros responden que los híbridos añaden complejidad y sobrecarga.
  • Debate sobre los plazos cuánticos: algunos creen que las amenazas cuánticas serias aún están lejos; otros señalan que grandes empresas ya están planificando descontinuar la criptografía previa a la era cuántica.
  • Hay escepticismo respecto a que las “debilidades PQC encontradas por LLM” se usen para impulsar o resistir la adopción de PQC.

Naturaleza de la contribución de la IA

  • Muchos ven los ataques como refinamientos asistidos por IA de ideas existentes, no como conceptos totalmente nuevos.
  • Varios lo comparan con que los LLM encuentren contraejemplos en matemáticas: búsqueda intensiva con buenas heurísticas sobre teoría conocida.
  • Una cuestión abierta clave es la reproducibilidad: ¿con qué frecuencia encuentra el sistema el “buen camino”, y cuánto es suerte estocástica frente a colaboración multiagente?

Coste, acceso e inequidad

  • Se informa que cada resultado costó alrededor de 100.000 dólares en uso de API durante aproximadamente una semana; algunos ven esto como evidencia de una emergente “aristocracia tecnológica”.
  • Otros argumentan que los costes bajarán, como ocurrió con los primeros ordenadores personales, y que los equipos internos naturalmente disfrutan de mayor rendimiento que los usuarios públicos.
  • Se hacen comparaciones con modelos no estadounidenses más baratos, con desacuerdo sobre si la ausencia de resultados públicos similares implica menor capacidad o simplemente distintas prioridades/secretismo.

Prompting, herramientas y “uso de IA” como habilidad

  • Los prompts utilizados son informales, repetitivos y llenos de erratas, lo que lleva a algunos a restar importancia a la “ingeniería de prompts” como disciplina.
  • Otros sostienen que la verdadera habilidad está en delimitar tareas, gestionar el contexto, notar cuándo el modelo se desvía o alucina, y tratarlo como a un colaborador junior.
  • Hay debate sobre configuraciones elaboradas de agentes (skills, archivos de configuración) frente a un acceso simple a herramientas con una ligera orientación; las experiencias difieren sobre si más estructura ayuda o perjudica.

Enmarcado, relaciones públicas y proceso de investigación

  • Varios comentaristas sienten que la introducción del blog exagera la novedad, dado que la posibilidad de tales debilidades ya era conocida.
  • Preocupaciones sobre sesgo de publicación y marketing: muchos intentos fallidos son invisibles, mientras que los éxitos se publicitan ampliamente.
  • Otros defienden esto como ciencia legítima: comprobar la afirmación del modelo, escribir un artículo y someterlo al escrutinio de la comunidad es el proceso normal.
  • Algunos temen una sobreinterpretación de estos resultados como “la IA es mejor que los criptógrafos”, en lugar de “la IA puede acelerar el trabajo incremental dentro de marcos definidos por humanos”.

Implicaciones más amplias para las matemáticas y los problemas abiertos

  • Existe la preocupación de que la IA haga triviales algunos problemas y otros se sientan “endurecidos”, desalentando el esfuerzo humano porque “incluso la IA no pudo resolverlo”.
  • Otros creen que los humanos seguirán trabajando en lo que la IA no puede hacer, usando potencialmente la IA como herramienta para explorar ideas simples pasadas por alto o generar construcciones candidatas.