お酒の味わいや香りを驚くほど左右するグラス
mail@yanagiya.biz
ITライター柳谷智宣
OpenAIの最新推論モデル「o3」は正答率が向上した一方、SimpleQAでのハルシネーション率がo1の0.44からo3では0.51へ、PersonQAでも0.16から0.33へと上昇したというOpenAI自身のレポートを紹介し、生成AIの幻覚とどう向き合うべきかを5つの対策として解説しています。ハルシネーションを減らすには小型モデルよりo1やo3など大きなモデルを使うこと、「わからない場合はわからないと答えよ」といったプロンプト指示や出典提示・自信度表明を求めるプロンプトエンジニアリング、複数の生成AIで結果を照合する多段階確認(最大6モデルを同時利用できる「天秤AI」の活用を提案)、資料をアップロードして参照範囲を限定するRAG(Google NotebookLMなど)、そして最終的な人間によるファクトチェックの5つを挙げ、ハルシネーションは不具合ではなく仕様だと腹をくくり、手間を惜しまず活用する姿勢が重要だとまとめています。
この要約は生成AIで作成しました。
