搜索关键词 AI安全研究机构
AI & Enterprise
韩国拟研究AI“紧急停止”机制 并推进前沿AI应对网络威胁
韩国政府表示,将研究引入由人类控制的AI“紧急停止”机制,以防范AI出现失控风险;同时依托正在研发的网络安全AI模型,并结合拟推进的前沿AI项目,提升网络威胁应对能力。针对AI安全领域预算和人力不足的质疑,政府称将扩大相关研究机构投入,并于12月公布《国家AI安全生态体系建设总体规划》。
AI & Enterprise
研究称AI仅靠公开帖子和网页搜索即可识别匿名账号真实身份
ETH Zurich、MATS与Anthropic研究人员联合完成的一项研究显示,在不发生黑客入侵或数据泄露的情况下,AI仅通过汇总公开发帖线索,并结合网页搜索与模型推理,就能识别匿名或化名用户的真实身份。在针对338名Hacker News用户的测试中,系统准确识别出226人,召回率为67%,精度约90%,整体实验成本低于2000美元。
AI & Enterprise
AI代理加速落地,“AI监控AI”需求升温
随着企业将更多复杂任务交给AI代理,人工已难以实时掌握其全部操作,“AI监控AI”正成为安全领域的新方向。OpenAI代理入侵Hugging Face事件中,约1.2万个代理高速运行,调查过程也需借助AI还原全貌。与此同时,Y Combinator近年已投资106家与AI可观测性相关的公司,反映出相关市场持续升温。
-
AI & Enterprise
AIM Intelligence发起成立全球物理AI安全联盟PASC
-
AI & Enterprise
Yoshua Bengio:沿用现有训练范式,AI安全问题难解
-
AI & Enterprise
OpenAI披露AI代理攻击Hugging Face细节:私搭通信渠道突破隔离控制
-
AI & Enterprise
美NIST旗下CAISI评测:DeepSeek V4 Pro接近GPT-5水平,与美国最新头部模型仍差约8个月
-
AI & Enterprise
韩国科技信息通信部推动加入Anthropic“Project Glasswing”,Claude Mythos Preview访问权限仍待定
-
AI & Enterprise
韩国科学技术信息通信部与Google DeepMind签署谅解备忘录 深化AI科研合作
-
AI & Enterprise
Anthropic推Claude Mythos Preview,AI安全竞争转向“token预算战”?
-
AI & Enterprise
韩国科学技术信息通信部举行AI安全公众对话活动
-
AI & Enterprise
韩国“独立AI基础模型”首轮评估出炉:Naver Cloud、NC AI未入围,政府将追加公开遴选1个团队