執筆・編集

相坂ソウタの最新論文紹介:AIの「嘘」はなぜ生まれるのか?OpenAIが自ら明かしたハルシネーションの構造的欠陥

相坂ソウタの最新論文紹介:AIの「嘘」はなぜ生まれるのか?OpenAIが自ら明かしたハルシネーションの構造的欠陥
mail@yanagiya.biz

OpenAIが2025年9月5日に公開した論文『なぜ言語モデルはハルシネーションを起こすのか』を紹介しています。著者カライ氏の博士論文タイトルや誕生日を尋ねると、チャットボットが自信満々に3つずつ異なる誤答を生成した例を挙げ、原因は現在の評価方法が不確実性の表明より推測を優遇する構造にあると指摘します。これは、分からない問題でも当てずっぽうで答えれば得点できる多肢選択式テストに似た仕組みだと説明。

GPT-5-thinking-miniとOpenAI o4-miniを比較すると、正答率は22%対24%とわずかにo4-miniが上回るものの、誤答率は26%対75%、棄権率は52%対1%と大きく異なりました。次単語予測に基づく事前学習には真偽ラベルがなく、誕生日のような低頻度の事実はランダムに近いため誤りやすいと画像分類の例を挙げて解説。解決策として、自信満々な誤答にはペナルティを、わからないという回答には部分点を与える採点方式への転換を提案しています。

この要約は生成AIで作成しました。

記事はこちら
相坂ソウタの最新論文紹介:AIの「嘘」はなぜ生まれるのか?OpenAIが自ら明かしたハルシネーションの構造的欠陥
相坂ソウタの最新論文紹介:AIの「嘘」はなぜ生まれるのか?OpenAIが自ら明かしたハルシネーションの構造的欠陥
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました