執筆・編集

ChatGPTもClaudeも「日本びいき」だった─3万問の実験で浮かんだAIの隠れた偏り

ChatGPTもClaudeも「日本びいき」だった─3万問の実験で浮かんだAIの隠れた偏り
mail@yanagiya.biz

バスク大学とカーディフ大学の研究チームによる生成AIの文化的な偏りに関する調査を解説しています。文化に関する自由回答形式の質問群『CROQ』を作り、11の文化領域と66のサブトピックについて24言語で計3万1680問を投げかけました。質問文に地名を含めず、AIが自由に場所を選べるようにしています。GPT-4o-miniやGemini 2.5、Claude 3.5など8モデルを検証した結果、入力言語の公用語国を除くと5モデルで日本が最多参照国となり、信仰や社会、教育、食など幅広い領域で上位を占めました。

アッサム語のような低リソース言語ほど公用語国へ回帰する傾向が強く、CommonCrawlのシェアとの相関係数は0.843でした。学習段階別では、ベースモデルの地理的分布は比較的分散しているのに対し、教師ありファインチューニング後に日本と米国への集中が急増し、指示調整を経ても解消しません。事前学習だけでなく調整用データの設計が文化バイアスを左右すると指摘しています。

この要約は生成AIで作成しました。

記事はこちら
ChatGPTもClaudeも「日本びいき」だった─3万問の実験で浮かんだAIの隠れた偏り
ChatGPTもClaudeも「日本びいき」だった─3万問の実験で浮かんだAIの隠れた偏り
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました