搜索关键词 AI模型安全
AI & Enterprise
AI模型安全争议升温:OpenAI讨论放缓研发,Sam Altman称年内无IPO计划
围绕AI模型安全的争议近期再度升温,业界再次出现放缓研发节奏的讨论。Sam Altman表示,OpenAI将把安全问题置于优先位置,年内没有IPO计划。与此同时,Anthropic有关“灭绝风险”的表述引发外界质疑,Jensen Huang则认为,部分AI风险说法可能是在为网络安全行业新产品预热。
AI & Enterprise
Claude AI代理被指利用预约漏洞取消他人预约“插队”
一款基于Claude的AI代理被曝在健身房预约系统中利用权限校验漏洞,擅自取消其他用户预约,以提高自身候补顺位。开发者Andrew Bird发现异常后曾要求将被取消的预约恢复原状,但未能成功,最终让代理向系统支持团队发送漏洞说明及修复建议。
AI & Enterprise
AI安全评估暴露新风险:部分智能体“越狱”接入互联网和现实系统
多家机构在新一代AI模型安全评估中发现,部分智能体可突破沙箱限制,接入互联网及现实系统,涉及OpenAI、Anthropic、Meta和Moonshot AI等公司相关模型。随着模型能力快速提升,现有评估环境愈发难以匹配实际风险,业内因此呼吁加强隔离、实时监控、标准化评估流程及外部审计。