の検索結果 ブラインド評価
AI & Enterprise
独自AI基盤モデルの第2段階評価、Motifは4位 3位LG AI Researchと3.2点差
科学技術情報通信部は、独自AI基盤モデルの第2段階評価の詳細を公表した。Motifはベンチマーク評価で首位だったが、専門家評価と利用者評価が伸びず総合4位となり、3位のLG AI Researchとの差は3.2点だった。
AI & Enterprise
Motif Technologies、韓国AI基盤モデル事業の2次評価に異議申し立て
Motif Technologiesは8月27日、韓国政府のAI基盤モデル事業の2次評価結果を巡り異議を申し立てた。項目別・企業別の得点や評価基準、配点根拠の開示と再審議を求めている。
AI & Enterprise
スタンフォード大学ロースクール研究、AI回答が教授回答を上回る 勝率75%
スタンフォード大学ロースクールの研究で、契約法に関する40の質問を使ったブラインド評価の結果、AIの回答が法学教授の回答を上回った。直接比較での勝率は約75%、学習を妨げる回答の比率も3.5%にとどまった。