据Axios当地时间9日报道,围绕“AI是否可能导致人类灭绝”的讨论,近期在研究圈和社交平台上迅速升温。
报道指出,本周舆论焦点之一,是外界发现部分AI研究人员长期以来一直在用具体数字评估并讨论人类灭绝风险,相关概率判断包括10%、20%,有时甚至更高。
引发这场争议的导火索,是一篇离职声明。曾在OpenAI工作、后加入Anthropic的研究者Jacob Cockson发文称,前沿AI公司正在“拿我们的生命做赌注”。该帖文在社交平台X(原Twitter)上的阅读量已超过1.1亿次。
随后,Anthropic对齐科学团队负责人Evan Hubinger公开表示认同这一判断,进一步推高了讨论热度。Hubinger称,他“真心相信AI可能杀死全人类”,并认为未来10年人类灭绝的概率至少为10%。他还表示,Anthropic目前仍未找到让超智能始终处于人类控制之下的方法。
对于这类表态,外界解读明显分化。有人认为,这是AI公司内部对风险问题的直接示警;也有人将其视为Anthropic在IPO前有意放大的“恐慌营销”,借此为2万亿美元估值预期造势。
事实上,AI可能引发人类灭绝风险的观点并非首次出现。诺贝尔奖得主Geoffrey Hinton曾估计,这一风险概率在10%至20%之间;Elon Musk给出的数字是20%。Anthropic CEO Dario Amodei去年在接受Axios采访时也表示,局势“真正朝着非常糟糕方向发展”的概率为25%。
Axios梳理称,相关担忧主要集中在几个方面:AI可能降低生物武器设计、网络攻击以及关键基础设施瘫痪的门槛;具备更强自主性的系统可能欺骗监管者、自我复制,并对人为终止产生抵抗。最极端的情景则是,AI自我改进的速度超过人类的控制能力。
Axios还指出,研究人员所说的“概率”与普通公众的直觉并不完全一致。在实验室内部讨论中,10%往往仍被视为一种高度不确定的风险判断;但放到现实生活中,如果某项风险达到这一水平,无论是乘坐飞机、使用新药,还是运行核反应堆,几乎都很难被公众接受。