搜索关键词 AI安全评估
AI & Enterprise
Anthropic与OpenAI考虑引入常驻外部安全评估员:持续审查研发流程,但无权叫停
Anthropic与OpenAI正推动由第三方安全评估机构常驻企业内部,持续审查前沿AI模型的研发流程与安全风险,并可在无需企业审改的情况下公开关键结论。不过,业内人士指出,这类评估员并无法定权限叫停高风险模型的开发或发布,其独立性、访问权限和评估周期也可能限制实际效果。
AI & Enterprise
Kakao发布Kanana-2安全评估结果:综合评分高于Gemma和Qwen
Kakao公布旗下开源轻量级语言模型Kanana-2系列的安全评估结果。此次评测依托公司自建AI安全评估平台,围绕有害内容、偏见等风险维度展开。结果显示,Kanana-2两款模型综合评分均为0.70,高于Google Gemma和Alibaba Qwen同等规模模型。Kakao表示,后续还将把评估范围扩展至多模态模型和Agentic AI。
AI & Enterprise
韩国科学技术信息通信部与KISA发布AI安全红队演练指南
韩国科学技术信息通信部与韩国互联网振兴院(KISA)联合发布《AI安全红队演练指南》,围绕提示注入、越狱、模型幻觉、代理劫持等生成式AI主要风险,提出面向企业的一线实践指引。指南同时将评估范围扩展至数据、训练链路、UI、系统提示词、API及基础设施,旨在推动行业建立常态化AI红队机制。