執筆・編集

AIに「共感」は芽生えるか? 最新論文が示す「ミラーニューロン」というアラインメントの新たな鍵

AIに「共感」は芽生えるか? 最新論文が示す「ミラーニューロン」というアラインメントの新たな鍵
mail@yanagiya.biz

英バース大学のRobyn Wyrick氏が公開した修士論文「Mirror-Neuron Patterns in AI Alignment」を取り上げています。従来のRLHFやConstitutional AIは外部からの制約でAIを制御しますが、AIが人間を超えると倫理的に振る舞うふりをする「欺瞞的アラインメント」の危険が生じます。着目したのは、自分の行動時と他者の観察時の両方で活性化し、共感の神経基盤とされるミラーニューロンです。

論文では2体のエージェントが協力する「Frog and Toad」というゲーム環境に、エネルギー消費による苦痛、片方が動けないと両方進めない相互依存性、自他の区別を曖昧にする「無知のヴェール」を組み込んで検証します。その結果、AIにミラーニューロンに似たパターンが現れ、独自指標CMNIは学習初期にピークを迎えた後に低下し、他者の苦痛を自分の苦痛として処理する回路も確認されました。外部制約から内部動機へと発想を転換する可能性を示しています。

この要約は生成AIで作成しました。

記事はこちら
AIに「共感」は芽生えるか? 最新論文が示す「ミラーニューロン」というアラインメントの新たな鍵
AIに「共感」は芽生えるか? 最新論文が示す「ミラーニューロン」というアラインメントの新たな鍵
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました