AIの進化は単一の巨大知能を生み出さない。エージェント群が創り出す「思考の社会」という未来
mail@yanagiya.biz
ITライター柳谷智宣
Google DeepMindが2025年10月9日に公開した、造語を使ってAIの振る舞いを制御する研究を解説しています。モデル本体のパラメーターを凍結したまま、語彙に新しい単語を追加して学習させる手法で、Gemma-3-4B-ITで7つの概念を試したところ平均92%の制御精度を達成しました。さらにAIに造語の意味を自分で説明させ、その説明文だけで同じ振る舞いを再現できるかを調べる「プラグイン評価」では83%が成功しています。
注目されるのは人間の語感とずれた「マシンオンリー同義語」の発見で、AIにとって「lack」が「簡潔さ」を意味する語として機能し、回答の文数がGemmaで42.9文から15.8文、Geminiで37文から4文へ短縮されました。3つの概念を同時に制御する実験でも、造語学習はFew-shot学習のスコア0.39を上回る0.48を記録しています。AIが人間とは異なる概念体系を築いている可能性を示し、共有語彙の構築が安全な活用の鍵になると述べられています。
この要約は生成AIで作成しました。
