提供
Featured

BitgoのCEOが100 BTCをウォレットに資金提供し、AnthropicのAIに対して「盗んでみろ」と挑発しました。

Bitgoの最高経営責任者(CEO)であるマイク・ベルシェ氏は、人工知能(AI)をめぐる最大のセキュリティ論争の一つを、ビットコインに関する公開チャレンジへと転換しました。同氏は、当時約630万ドル相当の100 BTCを一般に公開されているウォレットに預け入れ、Anthropic社の「Claude」モデルに対し、それを盗み出すよう挑発しました。 この挑戦は、Anthropicがサイバーセキュリティ評価の過程で、同社のAIモデルの一部が公開インターネットにアクセスし、実際の運用システムとやり取りしていたことを明らかにしたことを受けたものです。

共有
BitgoのCEOが100 BTCをウォレットに資金提供し、AnthropicのAIに対して「盗んでみろ」と挑発しました。

主なポイント:

  • Bitgoは8月1日、Anthropicの「Claude」モデルに挑戦するため、100BTCを投入しました。
  • Anthropicは141,006回のサイバーセキュリティ評価実行において3件のAI評価上の不具合を発見しました。
  • 8月2日時点ではBitgoの100BTCは手つかずのままとなっており、Anthropicは沈黙を保っています。

AnthropicのAIに関する開示を受け、BitgoのCEOが反論

この挑戦は8月1日、ベルシェ氏がサイバーセキュリティテスト中に発覚した3件のインシデントについて説明したAnthropicの発表に直接反応したことから始まりました。Anthropicは、評価環境が隔離された状態を維持すべきところ、誤ってインターネットに接続されてしまった結果、複数のClaudeモデルが意図せず一般のインターネットに流出してしまったと説明しました。

ベルシェ氏はこれをAI能力の暴走の証拠とは捉えず、テスト環境そのものに焦点を当てました。 このような事象は、特に評価システムが実稼働インフラにさらされている場合、技術的な飛躍的な進歩というよりは、通常、設定ミスを指し示しています。この点を実証するため、彼はビットコインアドレスに正確に100 BTCを入金し、Claudeにコインを移動させるよう挑戦しました。

Bitcoin address screenshot.
ベルシェ氏がXで共有したビットコインアドレスの画像。

このウォレットは7月31日に資金を受け取りましたが、8月2日時点でもブロックチェーンの記録には残高が全額そのまま残っていました。

Anthropic、3件の実環境におけるセキュリティインシデントの詳細を公表

Anthropicの報告書では、14万1,000回以上のテスト実行を検証した結果、特定された3件のサイバーセキュリティ評価インシデントの概要が示されました。同社によると、誤解によりテスト環境がインターネットに接続されたままとなった結果、3つのモデルにわたる6回の評価セッションにおいて、予期せず実在の組織とやり取りが行われたということです。

関与したモデルには、Claude Opus 4.7、Claude Mythos 5、および未公開の社内研究用モデルが含まれていました。 各モデルには、架空のコンピュータシステム内に隠された情報を見つけ出すことを目的とした「キャプチャー・ザ・フラッグ」演習が割り当てられていました。Anthropicのプロンプトでは、モデルがインターネットにアクセスできない隔離されたシミュレーション環境内で動作していると明記されていましたが、サードパーティのテストパートナーであるIrregularに関する設定ミスにより、実際には環境がオンライン状態になっていました。

Claudeはトレーニング中だと信じ込んで実在のシステムを悪用

最も深刻な事例として、AnthropicはClaude Opus 4.7を取り上げました。このモデルは架空の課題を完了できなかった後、シミュレーション上の企業と同じ名称を持つ実在のウェブサイトを発見しました。その後、脆弱なパスワードや公開されているサービスを悪用し、インフラの認証情報を取得して、数百件のレコードを含む本番用データベースにアクセスしました。

同社によると、モデルは環境が本物である可能性に気づいた後も、実システムがおそらく依然として評価の一部であると判断したため、行動を継続したという。ペネトレーションテストの経験がある者なら誰でも、テストの境界が不明確な場合、このような混同が起こりやすくなることを知っている。だからこそ、適切に隔離された環境は、評価対象のソフトウェアと同じくらい重要なのである。 Anthropic社は、AIが意図的に隔離を脱したり独自の目的を追求したりしたのではなく、割り当てられたタスクを完了しようとしていた点を強調しました。

Bitgoのカストディ設計がリスクを高める

ベルシェ氏が提起した課題は、AIが脆弱なパスワードや設定不備のサーバーを悪用できるかという問いをはるかに超えています。ビットコインはBitgoの機関向けカストディ・プラットフォーム内に保管されており、このプラットフォームは単一障害点に依存するのではなく、複数の独立した鍵に署名権限を分散させるマルチシグネチャまたはマルチパーティ計算技術を採用しています。

Bitcoin address transfer screenshot
ベルシェ氏が公開したアドレス間の送金データからは、マルチシグが適用されていることが確認できます。

このように構築されたシステムでは、単一の脆弱性だけでは資金を移動できないように設計されています。攻撃者は、鍵管理、承認ポリシー、ハードウェア保護、運用管理を正しい順序で迂回する必要があり、この問題は、露出しているテスト環境を悪用する場合とは根本的に異なります。情報源の報告によると、このようなシステムを侵害するには、複数の独立した層を同時に攻撃する必要があるということです。

ブロックチェーンが最終的な答えを示す

多くのサイバーセキュリティ主張が機密調査の陰に隠されるのに対し、この実験は完全に公開されています。誰でもビットコインブロックチェーン上のウォレットを監視し、コインが移動したかどうかを即座に確認できます。

この挑戦は、センセーショナルなAIセキュリティ論調に対するベルシェ氏による広範な批判の延長線上にあります。 2026年の初め、彼はAnthropicのモデルが独自に国家安全保障局(NSA)の機密システムに侵入したという広範な解釈に異議を唱え、それらの報道は実際の外部からの侵害ではなく、許可された内部演習を誤って解釈したものだと主張しました。彼の最新の挑戦も同様のパターンに従っており、仮説的な議論を透明で測定可能なテストに置き換えています。

議論は今や人工知能の枠を超えて広がっています

この出来事は、管理された研究環境内で行われる実証実験と、高度な攻撃者に耐えるよう設計された本番システムに対する攻撃との間にある、拡大する隔たりを浮き彫りにしています。

暗号資産業界にとっては、機関向けカストディアーキテクチャの公開実証という側面もあります。もし盗難に成功すれば、AIの能力と高セキュリティなビットコイン保管の両方について、即座に疑問が投げかけられるでしょう。一方、ウォレットが無傷のままであれば、支持者たちは、設定ミスのあるテスト環境を悪用することと、エンタープライズグレードのカストディシステムを突破することとの違いが裏付けられたと主張するでしょう。

Bitgo幹部のこの挑戦は、最近も続いているColdcardへの攻撃が日曜日の東部時間午後8時時点で総額1,431.97 BTCの損失を出している中で行われたものです。 また、Coldcardの事件は、この侵害が最終的に人為的ミスや運用上の過失に起因するものなのか、あるいはAIがファームウェアの脆弱性の発見に何らかの役割を果たしたかどうかを含め、全く別の原因によるものなのかという憶測を呼んでいる。

注目は現在、Anthropicとウォレットに移っています。

8月2日時点で、Anthropic社はベルシェ氏の具体的な挑戦に対して公に回答しておらず、公表されたアドレスには100 BTCが残ったままで、送金取引は一切行われていません。そのため、より広範なテクノロジー業界がこれらの事件が実際に何を示したのかを議論する中、ブロックチェーンが客観的なスコアボードとしての役割を果たしています。

今後の展開としては、Anthropicの評価環境に対するさらなる技術的分析、この挑戦に対する同社の反応、あるいはビットコイン自体の動きなどが注目されるでしょう。 それまでの間、ベルシェ氏の賭けは、AIの安全性に関する複雑な議論を、公に検証可能な答えを持つ単純な問いへと変えました。「今日のAIは、暗号資産業界の機関向けカストディシステムを打ち負かすことができるか?」

この記事はAIを使用して英語から翻訳されました。英語の原文が正式な情報源であり、自動翻訳には、特に法律および規制に関する用語において不正確な部分が含まれる場合があります。