“AI之父”Geoffrey Hinton表示,把AI导致人类灭绝的概率估在10%左右,并不算离谱。
据Business Insider 10日(当地时间)报道,Hinton近日在接受BBC采访时说,AI导致人类灭绝的概率很难精确计算,但10%这一判断并非夸大其词。
Hinton指出,AI具备超越人类智能的潜力,而人类社会此前从未真正面对过这类技术,因此很难对相关风险作出精细测算。他同时表示,即便把这一概率压低到1%,也未必是谨慎的判断;问题在于,目前没有人真正知道应如何给出合理估算。
更值得关注的是,Hinton对风险显现时间的判断正在持续提前。他表示,自己早年曾认为这类灾难可能发生在30至50年后,之后调整为10至20年,如今则认为风险可能在10年内出现,甚至来得更快。按他的说法,潜在威胁包括利用AI发动网络攻击,以及借助AI研发致命病毒等。
Hinton的警告,也与近期Anthropic相关人士的公开表态相互印证。曾在OpenAI和Anthropic从事预训练研究的Jacob Cockson在离开Anthropic时表示,“两家公司在相关问题上都未能采取负责任的做法”。他随后在X(原推特)发文批评称,AI公司正加速迈向具备自我改进能力的超级智能,无异于“拿人命下注”。他还写道,“甚至连打造AI的人也认真相信,10年内AI可能导致人类死亡”。
Anthropic对齐科学负责人Evan Hubinger也公开表达了类似担忧。他表示,自己确实严肃看待“AI可能杀死所有人类”这一风险,并认为未来10年内出现这种情况的概率超过10%。不过,Anthropic此前一直强调,当前模型本身的直接风险仍然较低,真正的核心争议在于,AI是否会通过递归自我改进走向超级智能。
所谓“递归自我改进”,是指AI自行设计并训练更强的后续模型,从而形成加速演进的假设路径。报道指出,近期主要AI公司正持续向模型扩展投入数十亿美元,而新模型之间即便只相隔几个月,性能提升幅度也在不断拉大,这被视为相关担忧持续升温的背景之一。不过,Hinton并未进一步说明,为何他将风险时间判断再次提前。
从市场和行业动向看,技术竞赛的推进速度正明显快于安全治理讨论。Cockson离开Anthropic的时间点,也恰逢市场对Anthropic IPO预期升温之际。内部研究人员和安全负责人公开谈及“人类灭绝风险”,显示AI公司的增长战略与安全体系正同时面临检验。
Hinton再次强调国际合作的重要性。他认为,在防止AI取代人类或夺取控制权的问题上,各国利益是一致的,“最终会合作”。但问题在于,这种合作能否及时落地。在超级智能竞赛持续推高研发速度的背景下,监管与安全标准能否跟上,正成为下一阶段的核心议题。