Naver宣布,已将AI服务可能出现的潜在风险细分为110项,并将相关安全管理覆盖至设计、开发、上线和运营全流程。
公司9月16日表示,首次发布《AI安全性进展报告》,公开自研AI安全框架“ASF 2.0”及其执行体系“CHEC 2.0”在真实服务中的应用情况。
据介绍,ASF 2.0是Naver的AI安全管理体系,覆盖范围不仅包括AI模型的性能和风险水平,也延伸至用户与服务保护。该体系聚焦服务设计、开发、上线及运营等环节,强调贯穿全流程的安全管理。
此次报告还系统介绍了ASF 2.0及CHEC 2.0在实际服务场景中的落地过程。
在风险识别方面,Naver基于法律、社会和产业案例,构建了“N-ARTI”体系,将AI服务潜在风险细分为110项。该体系既反映不同服务的特性,也为公司内部AI风险识别与分类提供统一标准。
在此基础上,Naver还建立了“护栏”机制,对生成式AI的输出进行约束,避免回复偏离既定安全标准。
与此同时,公司还推出了用于评估AI回复安全性的“N-ASET”。这一工具从“有害性”和“可用性”两大维度对AI响应进行评估,不仅检查是否包含有害内容,也会判断回复是否切合用户提问,以及是否具备免责声明、专家指引等必要的安全要素。
Naver还披露了相关落地案例。以AI购物代理和天气服务为例,公司会在相关功能中明确标识AI的使用情况,并向用户作出说明。于今年6月推出的“AI Tab”也已引入CHEC 2.0,对设计、开发到上线各环节进行安全检查。
Naver表示,未来将扩大与韩国科学技术院(KAIST)、首尔大学人工智能政策倡议(SAPI)、高丽大学人工智能安全研究中心、人工智能安全研究所(AISI)等高校及专业机构的合作,持续推进AI服务风险识别、预防与缓释研究。
Naver AI安全中心负责人Seongjae Won表示,随着AI技术加速融入用户日常生活,AI安全性已进入需要在真实服务环境中具体应对的阶段。公司将把以人为本的价值置于最高优先级,持续迭代并推广ASF 2.0,以预防并缓解服务中可能出现的风险。