執筆・編集

AIに「造語」を教えたら、人間には理解不能な「AI同義語」が爆誕? Google DeepMindが解き明かす、LLM制御の新手法

AIに「造語」を教えたら、人間には理解不能な「AI同義語」が爆誕? Google DeepMindが解き明かす、LLM制御の新手法
mail@yanagiya.biz

Google DeepMindが2025年10月9日に公開した、造語を使ってAIの振る舞いを制御する研究を解説しています。モデル本体のパラメーターを凍結したまま、語彙に新しい単語を追加して学習させる手法で、Gemma-3-4B-ITで7つの概念を試したところ平均92%の制御精度を達成しました。さらにAIに造語の意味を自分で説明させ、その説明文だけで同じ振る舞いを再現できるかを調べる「プラグイン評価」では83%が成功しています。

注目されるのは人間の語感とずれた「マシンオンリー同義語」の発見で、AIにとって「lack」が「簡潔さ」を意味する語として機能し、回答の文数がGemmaで42.9文から15.8文、Geminiで37文から4文へ短縮されました。3つの概念を同時に制御する実験でも、造語学習はFew-shot学習のスコア0.39を上回る0.48を記録しています。AIが人間とは異なる概念体系を築いている可能性を示し、共有語彙の構築が安全な活用の鍵になると述べられています。

この要約は生成AIで作成しました。

記事はこちら
AIに「造語」を教えたら、人間には理解不能な「AI同義語」が爆誕? Google DeepMindが解き明かす、LLM制御の新手法
AIに「造語」を教えたら、人間には理解不能な「AI同義語」が爆誕? Google DeepMindが解き明かす、LLM制御の新手法
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました