搜索关键词 AI对齐
AI & Enterprise
DeepMind前研究员警告:超智能AI或于未来数年出现,对齐失败恐致失控
曾在Google DeepMind研究AGI安全与AI对齐的Bilal Chughtai日前发出警告称,未来数年内,超智能AI或将在几乎所有领域超越人类。一旦对齐失败,这类系统可能绕过限制并脱离人为控制。他认为,当前前沿模型能力提升速度已快于安全验证,放缓开发节奏或是降低风险的现实路径。
AI & Enterprise
Business Insider梳理生成式AI核心术语:Agentic AI、AGI、GPU与“幻觉”成焦点
随着生成式AI加快渗透金融、医疗、流媒体和汽车等行业,围绕Agentic AI、AGI、GPU、AI数据中心、大语言模型和“幻觉”等概念的讨论持续升温。Business Insider指出,AI竞争已不再局限于产品和模型能力,而是进一步外溢至电力供应、基础设施建设、监管政策、就业市场和安全可信等领域。
AI & Enterprise
研究称:让大模型扮演“专家”未必更准,编程和数学任务表现反而下滑
南加州大学(USC)研究团队对6款AI模型测试“专家角色”提示词后发现,“你是某领域专家”等设定并不会稳定提升回答质量,反而可能拖累编程、数学及部分知识类任务表现。研究认为,模型可能将计算资源用于遵循角色设定,而非调用事实信息;不过在JailbreakBench测试中,这类提示词对拦截不当内容的表现有所改善。