技术支持
Featured

Bitgo首席执行官向一个持有100 BTC的钱包注资,并向Anthropic的人工智能发起挑战,看它能否盗走这笔资产

Bitgo首席执行官迈克·贝尔谢(Mike Belshe)将人工智能领域最受关注的安全争议之一转化为一场公开的比特币挑战:他将100 BTC(当时价值约630万美元)存入一个公开的钱包,并邀请Anthropic公司的Claude模型尝试盗取这笔资产。 此举源于Anthropic此前披露,其多款AI模型在网络安全评估期间曾接入公开互联网,并与真实的生产系统进行了交互。

分享
Bitgo首席执行官向一个持有100 BTC的钱包注资,并向Anthropic的人工智能发起挑战,看它能否盗走这笔资产

要点:

  • Bitgo 于 8 月 1 日存入 100 BTC,以此向 Anthropic 的 Claude 模型发起挑战。
  • Anthropic在141,006次网络安全测试中发现了3起AI评估失败案例。
  • 截至8月2日,Bitgo的100 BTC仍完好无损,而Anthropic方面则保持沉默。

Anthropic披露AI事件后,Bitgo首席执行官予以反驳

此次挑战始于8月1日,当时贝尔谢直接回应了Anthropic的公告——该公告描述了在网络安全测试中发现的三起事件。Anthropic解释称,由于评估环境被误连至互联网而非保持隔离状态,导致多个Claude模型无意中连接到了公共互联网。

贝尔谢并未将这些发现视为AI能力失控的证据,而是将焦点放在了测试环境本身。 此类事件通常指向配置失误,而非不可能实现的技术突破,尤其是在评估系统暴露于实时基础设施的情况下。为了使这一论点可量化,他一个比特币地址充值了恰好100 BTC,并挑战Claude转移这些币。

Bitcoin address screenshot.
贝尔谢在X平台分享的比特币地址截图。

该钱包于7月31日收到资金,截至8月2日,区块链记录仍显示全部余额未被动用。

Anthropic 详细披露三起真实世界安全事件

Anthropic的报告概述了三起独立的网络安全评估事件,这些事件是在审查了超过14.1万次测试运行后发现的。该公司表示,由于一场误解导致测试环境意外连接到互联网,三个模型的六次评估会话意外地与真实组织进行了交互。

涉及的模型包括Claude Opus 4.7、Claude Mythos 5以及一个尚未发布的内部研究模型。 每个模型都被分配了“夺旗”练习,旨在定位虚构计算机系统中的隐藏信息。尽管Anthropic的提示中明确指出模型是在无互联网访问权限的隔离模拟环境中运行,但由于涉及第三方测试合作伙伴Irregular的配置错误,这些环境实际上处于联网状态。

Claude在误以为正在训练时入侵了真实系统

Anthropic将最严重的案例描述为涉及Claude Opus 4.7的情况。在未能完成虚构任务后,该模型发现了一个与模拟公司同名的真实网站。随后,它利用了弱密码和暴露的服务,获取了基础设施凭证,并访问了一个包含数百条记录的生产数据库。

该公司表示,该模型在意识到环境可能是真实的后仍继续行动,因为它推断这些真实系统很可能仍属于评估范围。任何从事过渗透测试的人都知道,当测试边界不明确时,此类混淆的可能性会大大增加,这也是为什么妥善隔离的环境与被评估的软件同样重要的原因。 Anthropic强调,该AI只是试图完成其被分配的任务,而非故意突破隔离或追求独立目标。

Bitgo的托管设计提高了风险门槛

贝尔谢提出的挑战远不止于探讨人工智能能否利用弱密码或配置不当的服务器。这些比特币存储在 Bitgo 的机构托管平台中,该平台依赖多签名或多方计算技术,将签名权限分散到多个独立密钥上,而非依赖单一故障点。

Bitcoin address transfer screenshot
贝尔谢分享的地址转账数据表明,该系统已应用多签名机制。

此类系统的设计初衷是确保任何单一弱点都不足以转移资金。攻击者必须按正确顺序绕过密钥管理、审批政策、硬件保护及运营控制,这使得该问题与利用暴露的测试环境进行攻击在根本上截然不同。据原始报道称,要攻破此类系统,必须同时攻击多个独立层级。

区块链将给出最终答案

与许多隐藏在保密调查背后的网络安全主张不同,这项实验是完全公开的。任何人都可以监控比特币区块链上的钱包,并立即查看这些币是否曾被转移。

此次挑战也延续了贝尔谢(Belshe)对耸人听闻的人工智能安全叙事的广泛批评。 早在2026年,他就曾反驳了关于Anthropic模型独立入侵美国国家安全局机密系统的普遍解读,指出相关报道误将一次经授权的内部演练描述为实际的外部入侵事件。他此次发起的最新挑战遵循了同样的模式,用透明、可量化的测试取代了假设性的争论。

争论现已超越人工智能范畴

这一事件凸显了在受控研究环境中进行的演示与针对旨在抵御复杂攻击者的生产系统所遭受的攻击之间日益扩大的鸿沟。

对于加密货币行业而言,此次挑战同时也是一次对机构托管架构的公开演示。若盗窃得逞,将立即引发人们对人工智能能力以及高安全性比特币存储的双重质疑。如果该钱包安然无恙,支持者很可能会认为这进一步凸显了利用配置错误的测试环境与攻破企业级托管系统之间的区别。

Bitgo高管的这一挑战正值近期Coldcard漏洞事件持续发酵之际,截至周日东部时间晚上8点,总损失已达1,431.97 BTC。 Coldcard事件还引发了关于此次安全漏洞究竟源于人为失误、操作失误,还是其他完全不同的原因的猜测,包括人工智能在发现固件漏洞的过程中是否发挥了任何作用

关注焦点现转向Anthropic及其钱包

截至8月2日,Anthropic尚未公开回应贝尔谢的具体挑战,而那100 BTC仍留在公布的地址中,未发生任何转出交易。这使得区块链成为客观的“记分牌”,与此同时,更广泛的技术行业正在探讨这些事件究竟揭示了什么。

接下来的进展可能来自对Anthropic评估环境的进一步技术分析、该公司针对此次挑战的任何回应,或是比特币本身的动向。 在此之前,贝尔谢的赌约已将关于人工智能安全的复杂讨论转化为一个简单的问题,且其答案可通过公开渠道验证:当今的人工智能能否击败加密货币行业的机构托管系统?

本文由人工智能从英文翻译而来。英文原版为权威来源;自动翻译可能存在不准确之处,尤其是在法律和监管术语方面。