Impulsado por
Featured

El director general de Bitgo financia una cartera con 100 BTC y reta a la IA de Anthropic a que se la robe

El director ejecutivo de Bitgo, Mike Belshe, convirtió uno de los mayores debates sobre seguridad en el ámbito de la inteligencia artificial en un reto público relacionado con el bitcoin al depositar 100 BTC —con un valor aproximado de 6,3 millones de dólares en ese momento— en un monedero de dominio público e invitar a los modelos «Claude» de Anthropic a que lo robaran. Esta iniciativa se produjo tras la revelación por parte de Anthropic de que varios de sus modelos de IA habían accedido a la red abierta e interactuado con sistemas de producción reales durante las evaluaciones de ciberseguridad.

ESCRITO POR
COMPARTIR
El director general de Bitgo financia una cartera con 100 BTC y reta a la IA de Anthropic a que se la robe

Puntos clave

  • Bitgo depositó 100 BTC el 1 de agosto para desafiar a los modelos Claude de Anthropic.
  • Anthropic detectó tres fallos en la evaluación de la IA en un total de 141 006 pruebas de ciberseguridad.
  • Los 100 BTC de Bitgo seguían intactos a fecha de 2 de agosto, mientras que Anthropic guardaba silencio.

El director ejecutivo de Bitgo responde tras la revelación de Anthropic sobre la IA

El desafío comenzó el 1 de agosto, cuando Belshe respondió directamente al comunicado de Anthropic en el que se describían tres incidentes descubiertos durante las pruebas de ciberseguridad. Anthropic explicó que varios modelos de Claude accedieron involuntariamente a la red pública de Internet después de que los entornos de evaluación se conectaran por error a Internet en lugar de permanecer aislados.

En lugar de considerar estos hallazgos como una prueba de la capacidad descontrolada de la IA, Belshe se centró en la propia configuración de las pruebas. Incidentes como estos suelen apuntar a fallos de configuración más que a avances técnicos imposibles, especialmente cuando los sistemas de evaluación están expuestos a una infraestructura activa. Para que el reto fuera cuantificable, ingresó exactamente 100 BTC en una dirección de bitcoin y retó a Claude a mover las monedas.

Bitcoin address screenshot.
Imagen de la dirección de bitcoin que Belshe compartió en X.

El monedero recibió los fondos el 31 de julio y, a fecha de 2 de agosto, los registros de la cadena de bloques seguían mostrando el saldo íntegro sin alteraciones.

Anthropic detalla tres incidentes de seguridad en el mundo real

El informe de Anthropic describió tres incidentes distintos de evaluación de ciberseguridad identificados tras revisar más de 141 000 ejecuciones de pruebas. La empresa afirmó que seis sesiones de evaluación en tres modelos interactuaron inesperadamente con organizaciones reales después de que, debido a un malentendido, los entornos de prueba quedaran conectados a Internet.

Entre los modelos implicados se encontraban Claude Opus 4.7, Claude Mythos 5 y un modelo de investigación interno aún no publicado. A cada uno se le habían asignado ejercicios de «captura de la bandera» diseñados para localizar información oculta en sistemas informáticos ficticios. Aunque las instrucciones de Anthropic indicaban que los modelos operaban dentro de simulaciones aisladas sin acceso a Internet, los entornos estaban en realidad conectados a la red debido a un error de configuración relacionado con Irregular, un socio de pruebas externo.

Claude explotó sistemas reales creyendo que estaba entrenándose

Anthropic describió el caso más grave como el relacionado con Claude Opus 4.7. Tras no completar su tarea ficticia, el modelo localizó un sitio web real que compartía el mismo nombre que la empresa simulada. A continuación, aprovechó contraseñas débiles y servicios expuestos, recuperó credenciales de la infraestructura y accedió a una base de datos de producción que contenía varios cientos de registros.

La empresa afirmó que el modelo continuó tras reconocer que el entorno podría ser real, ya que concluyó que los sistemas reales probablemente seguían formando parte de la evaluación. Cualquiera que haya trabajado en pruebas de penetración sabe que este tipo de confusión es mucho más probable cuando los límites de la prueba no están claros, razón por la cual unos entornos debidamente aislados son tan importantes como el propio software que se está evaluando. Anthropic hizo hincapié en que la IA intentaba completar la tarea que se le había asignado, en lugar de escapar deliberadamente de la contención o perseguir objetivos independientes.

El diseño de custodia de Bitgo eleva el nivel de riesgo

El reto de Belshe va mucho más allá de preguntarse si una IA puede aprovechar contraseñas débiles o servidores mal configurados. El bitcoin se encuentra dentro de la plataforma de custodia institucional de Bitgo, que se basa en tecnología de multifirma o de computación multipartita que distribuye la autoridad de firma entre múltiples claves independientes, en lugar de depender de un único punto de fallo.

Bitcoin address transfer screenshot
Los datos de transferencia de direcciones que compartió Belshe muestran que se ha aplicado la multifirma.

Los sistemas construidos de esta manera están diseñados para que ninguna debilidad por sí sola sea suficiente para mover fondos. Un atacante tendría que eludir la gestión de claves, las políticas de aprobación, las protecciones de hardware y los controles operativos en la secuencia correcta, lo que hace que el problema sea fundamentalmente diferente de la explotación de un entorno de pruebas expuesto. Según el informe original, comprometer un sistema de este tipo requeriría atacar varias capas independientes simultáneamente.

La cadena de bloques dará la respuesta definitiva

A diferencia de muchas afirmaciones sobre ciberseguridad que permanecen ocultas tras investigaciones confidenciales, este experimento es totalmente público. Cualquiera puede supervisar el monedero en la cadena de bloques de Bitcoin y comprobar de inmediato si las monedas se mueven en algún momento.

El desafío también da continuidad a la crítica más amplia de Belshe hacia las narrativas sensacionalistas sobre la seguridad de la IA. A principios de 2026, rebatió las interpretaciones generalizadas de que un modelo de Anthropic había violado de forma independiente los sistemas clasificados de la Agencia de Seguridad Nacional, argumentando que los informes caracterizaban erróneamente un ejercicio interno autorizado en lugar de una violación externa real. Su último desafío sigue el mismo patrón al sustituir los debates hipotéticos por una prueba transparente y cuantificable.

El debate se extiende ahora más allá de la inteligencia artificial

Este episodio pone de relieve una brecha cada vez mayor entre las demostraciones realizadas en entornos de investigación controlados y los ataques contra sistemas de producción diseñados para resistir a adversarios sofisticados.

Para el sector de las criptomonedas, el reto también sirve como demostración pública de la arquitectura de custodia institucional. Un robo exitoso plantearía inmediatamente dudas tanto sobre las capacidades de la IA como sobre el almacenamiento de bitcoins de alta seguridad. Si la cartera permanece intacta, es probable que sus defensores argumenten que esto refuerza la diferencia entre explotar entornos de prueba mal configurados y burlar sistemas de custodia de nivel empresarial.

El reto del ejecutivo de Bitgo llega mientras sigue desarrollándose el reciente ataque a Coldcard, cuyas pérdidas totales alcanzaban los 1.431,97 BTC a las 20:00 horas (hora del Este) del domingo. El caso de Coldcard también ha alimentado las especulaciones sobre si la brecha se debió en última instancia a un error humano, a fallos operativos o a otra causa totalmente distinta, incluyendo si la IA desempeñó algún papel en el descubrimiento de la vulnerabilidad del firmware.

La atención se centra ahora en Anthropic y la cartera

A fecha de 2 de agosto, Anthropic no había respondido públicamente al reto específico de Belshe, y los 100 BTC seguían en la dirección publicada sin que se hubiera registrado ninguna transacción de salida. Esto hace que la cadena de bloques sirva como marcador objetivo mientras el sector tecnológico en general debate qué es lo que realmente han demostrado estos incidentes.

Es probable que los próximos avances provengan de un análisis técnico adicional de los entornos de evaluación de Anthropic, de cualquier respuesta de la empresa respecto al desafío o del movimiento del propio bitcoin. Hasta entonces, la apuesta de Belshe ha convertido un complejo debate sobre la seguridad de la IA en una pregunta sencilla con una respuesta verificable públicamente: ¿Puede la IA actual burlar los sistemas de custodia institucional del sector de las criptomonedas?

Este artículo fue traducido del inglés mediante IA. La versión original en inglés es la fuente autorizada; las traducciones automáticas pueden contener imprecisiones, especialmente en la terminología legal y regulatoria.