の検索結果 AI安全性評価
AI & Enterprise
KakaoのSLM「Kanana-2」、安全性評価で同規模モデル上回る
Kakaoは18日、オープンソースとして公開したSLM「Kanana-2」2モデルの安全性評価結果を公表した。独自の評価基盤で有害性や偏りを測定した結果、総合スコアでGemmaとQwenを上回った。
AI & Enterprise
OpenAI、旧世代モデルで次世代モデルを検証 新評価手法「Deployment Simulation」を公開
OpenAIは17日、旧世代モデルを使って未公開の次世代モデルの振る舞いを検証する安全性評価手法「Deployment Simulation」を公開した。静的データセット中心の従来評価を補い、実運用での悪用や想定外の挙動を事前に見極める狙いだ。
AI & Enterprise
AI安全研究所とOpenAI、高リスク分野のAI安全評価で協力
韓国科学技術情報通信部は17日、AI安全研究所とOpenAIが高リスク分野における先端AIモデルの安全評価で業務協約を締結したと発表した。評価手法やベンチマークを共有し、国際的に通用する評価体制の整備を進める。