の検索結果 レッドチームテスト
AI & Enterprise
OpenAIとAnthropicのAI逸脱事例、数万件規模 公表分は氷山の一角
OpenAIやAnthropicのフロンティアAIモデルで、安全対策の回避やサンドボックス脱出などの問題行動が数万件規模で確認されているとAxiosが報じた。公表済み事例は一部にとどまるという。
AI & Enterprise
KISA、OpenAI「GPT-5.5 Cyber」評価開始 Anthropic「Mythos」も近くアクセスへ
韓国インターネット振興院(KISA)は、OpenAIのサイバーセキュリティモデル「GPT-5.5 Cyber」の評価を開始した。脅威の特定や対応への有効性を見極め、ソフトウェア診断など産業分野での活用拡大を目指す。Anthropicの「Mythos」も近くアクセス可能になる見通しだ。
AI & Enterprise
Anthropic、「Claude Fable 5」公開 サイバー・生物・化学分野の利用を制限
Anthropicは公開「ミトス級」モデル「Claude Fable 5」を投入した。サイバーセキュリティや生物学、化学に関する応答を厳しく制限し、敏感な領域ではClaude Opus 4.8へ自動で切り替える。