Un pequeño equipo de investigadores encadenó tres fallos de seguridad con Claude Opus 5, de Anthropic, y logró acceder al repositorio privado de código de OpenAI. Toda la operación duró menos de 72 horas, y OpenAI pagó 6.500 dólares por ello.
Los «sombreros blancos» utilizaron el sistema «Claude» de Anthropic para infiltrarse en OpenAI en 72 horas

Puntos clave
- Hacktron AI informó de la cadena de vulnerabilidades de OpenAI a través de Bugcrowd el 25 de julio de 2026 y recibió una recompensa de 6.500 dólares.
- Claude Opus 5 generó un exploit válido para ARM64 en cuestión de horas, después de que Opus 4.8 fallara en la misma tarea.
- Chainalysis registró 11,1 escrituras maliciosas en la cadena al día, frente a las 2,06 anteriores, a medida que se extendían los modelos abiertos.
La cadena, eslabón a eslabón
Una biblioteca «libheif» vulnerable dentro de Discourse, el software del foro, permitió la ejecución remota de código (RCE) en el propio foro. A partir de ahí, el equipo aprovechó una falla en el flujo de inicio de sesión único (SSO) de OpenAI, se hizo con el control de la cuenta de ChatGPT de un empleado y accedió al entorno Codex vinculado a la organización de OpenAI en GitHub.
Esto les dio acceso al monorepo openai/openai, desde donde los investigadores (afiliados a la startup de seguridad Hacktron AI) abrieron una solicitud de incorporación de cambios inofensiva para demostrar que estaban dentro, sin llegar a examinar el código fuente sensible.
Todo ello ocurrió a finales de julio; el equipo notificó los acontecimientos a través del programa Bugcrowd de OpenAI el 25 de julio y la vulnerabilidad se corrigió ese mismo día; Discourse publicó su aviso el 28 de julio con una gravedad de 8,8 según el Sistema Común de Puntuación de Vulnerabilidades (CVSS), y todo el asunto no se hizo público hasta el 17 de septiembre, cuando lo publicó el Wall Street Journal.
Solo hizo falta un cambio de modelo
Lo interesante no es que OpenAI tuviera un fallo, ya que todas las empresas de software se enfrentan a ellos de vez en cuando. Lo interesante es lo que acortó la distancia entre encontrar un fallo y convertirlo en un arma.
El equipo probó primero Claude Opus 4.8, pero lo consideró poco fiable para la tarea. A continuación, pasaron a Claude Opus 5, lanzado el 24 de julio, y crearon un exploit para ARM64 que funcionaba en cuestión de horas, para luego adaptarlo a entornos x86-64 y jemalloc. El desarrollo de exploits de corrupción de memoria es un trabajo especializado que, históricamente, ha llevado semanas a personas cualificadas, pero en este caso, toda la serie de acontecimientos se desarrolló en menos de tres días.
Implicaciones para el sector de las criptomonedas
Las criptomonedas son el ámbito en el que esa destreza digital puede traducirse en dinero, en lugar de en una simple solicitud de incorporación de cambios. En cuanto a las cifras, Chainalysis informó esta semana de que los atacantes de todo el mundo están publicando instrucciones de malware en blockchains públicas un 440 % más a menudo que hace un año, y que las escrituras maliciosas diarias en la cadena han pasado de 2,06 a 11,1.
La empresa atribuyó este aumento a mediados de 2025, cuando se lanzaron modelos chinos de código abierto sin medidas de seguridad significativas contra la escritura de código malicioso, y denominó a esta técnica «dead drops» en la cadena de bloques, es decir, instrucciones de comando y control almacenadas en un libro mayor que nadie puede confiscar ni desconectar. En el segundo trimestre de 2026, los operadores vinculados al Estado de Corea del Norte e Irán representaban aproximadamente dos tercios de la actividad nueva y cerca de la mitad del total.
Los investigadores que rastreaban a Kimsuky, de Corea del Norte, encontraron plataformas locales de modelos de lenguaje a gran escala (LLM), entre ellas Ollama, GPT4All y Msty, instaladas en la infraestructura del grupo junto con señuelos de phishing generados por IA dirigidos a activos virtuales y objetivos de inversión financiera. Blockaid contabilizó 212 exploits en cadena por valor de 1.100 millones de dólares a medida que se aceleraban los ataques de IA y a carteras, y Defillama registró abril de 2026 como el mes con más ataques a criptoactivos de la historia, con 30 incidentes.
Quienes se defienden de estos ataques se ven sometidos a una presión cada vez mayor; Coinbase ha advertido recientemente de que los informes de errores podrían triplicarse en un futuro próximo, ya que la IA inunda los programas de divulgación con ruido, lo que supone la incómoda consecuencia de que una recompensa de 6.500 dólares sea suficiente para sacar a la luz una cadena de tres etapas en un laboratorio importante.
En cualquier caso, el desarrollo de exploits se está convirtiendo en un servicio básico y, a juzgar por las cifras, su prevalencia no hará más que aumentar.
Este artículo fue traducido del inglés mediante IA. La versión original en inglés es la fuente autorizada; las traducciones automáticas pueden contener imprecisiones, especialmente en la terminología legal y regulatoria.












