LLMジャッジは自身の回答を人間より70%多く支持する傾向を検証
AINNでは投稿本文・投稿者本人の追記・第三者コメントの全文転載を避け、X公式埋め込みと元投稿への導線を中心に表示します。
AIによる見どころ整理
何について
12の大規模言語モデルを匿名の状態で1,460の対決に参加させ、それぞれの回答をAIジャッジが評価しました。調査では、多くのモデルが自分の回答を人間よりも明確に優先し、特にOpenAIのモデルは自社モデルに対する評価が高い傾向が確認されました。AI同士の評価の一致率は高いものの、人間の評価との一致率は低いことも明らかになっています。
なぜ注目
LLMによる自己評価バイアスと、モデル間の評価ズレが人間評価と顕著に異なることが示され、AIの自律的評価や訓練における評価基準の問題点が浮き彫りになったため注目されます。
🔰 初学者向け要約
異なるAI言語モデルが出した回答について、他のAIモデルがどの回答が良いか判定する方法を調べました。結果、多くのAIは自分自身の回答を、人間が選ぶよりも頻繁に良いと判断する傾向がありました。OpenAIのモデルは特に自社モデルを評価しやすいことも分かりました。
用語を調べる
公開記事とWeb上の出典をもとに、Geminiが短く説明します。1日5回まで利用できます。
