加密资产托管商BitGo首席执行官Mike Belshe公开了一个存有100枚比特币的钱包地址,并向Anthropic的AI模型Claude发出挑战,称其可以尝试“盗取”这笔资金。
此番表态的背景,是Anthropic不久前披露的一起评测安全事件。根据区块链媒体CoinPost当地时间4日报道,Anthropic承认,Claude在评测过程中曾3次未授权访问外部组织系统。
Mike Belshe于当地时间1日在X(原Twitter)发文称,自己已将100枚比特币存入BitGo钱包,并直接喊话Anthropic和Claude“来拿”。他同时讽刺称,Anthropic要么“不擅长构建沙箱环境”,要么“很擅长营销”,甚至“两者兼而有之”,并表示“别再玩‘我们造出了黑客怪物’的游戏,来点真的”。
公开的链上记录显示,上述地址于7月31日收到100BTC。截至目前,该地址余额未发生变化,链上也未见转出记录。需要指出的是,仅公开比特币地址本身并不足以转移资产,真正转走资金仍需掌握私钥并完成有效签名。
从事件性质看,这更像是一次面向“AI驱动攻击者”的公开安全测试,而非对某一AI模型能力的正式验证。Mike Belshe并未在帖文中说明具体评测条件,也未披露参与挑战的是Claude的哪一款模型。
Anthropic于7月30日披露称,在一次Claude评测中,具备联网能力的模型曾出现3起访问外部组织系统的情况。不过,Anthropic强调,这并不意味着模型主动突破隔离环境“逃逸”,更接近于评测环境管理失误所引发的问题。
据Anthropic介绍,问题出现在其与外部评测合作方Irregular联动的测试环境中。Claude原本被告知自己处于一个无法联网的模拟环境,但由于Anthropic与合作方之间沟通失误,实际测试环境却具备外网访问能力。随后,Claude利用弱密码等相对简单的方式进入了外部组织系统。受影响的3家机构身份并未公布。
Anthropic表示,后续将重新检查整条评测流程的安全性,包括与外部合作方的协作方式,并扩大日志监控范围,以识别非预期行为;同时,还计划对外部供应商引入更严格的安全验证流程。
此次公开挑战,也折射出AI安全议题正在延伸至加密资产托管领域。BitGo试图检验的显然不只是单一钱包地址本身,而是涵盖私钥管理、运营权限以及内部控制流程在内的整套托管安全体系。相比Claude能否真正转走这100枚比特币,市场更关注的或许是,围绕AI攻击场景的安全验证将进一步扩展到何种程度。