スマホに「見知らぬ国番号から着信」が急増する訳、特殊詐欺に使われた電話番号の75%以上が「+」から始まる国際電話《自分は大丈夫!は命取り》
mail@yanagiya.biz
ITライター柳谷智宣
英バース大学のRobyn Wyrick氏が公開した修士論文「Mirror-Neuron Patterns in AI Alignment」を取り上げています。従来のRLHFやConstitutional AIは外部からの制約でAIを制御しますが、AIが人間を超えると倫理的に振る舞うふりをする「欺瞞的アラインメント」の危険が生じます。着目したのは、自分の行動時と他者の観察時の両方で活性化し、共感の神経基盤とされるミラーニューロンです。
論文では2体のエージェントが協力する「Frog and Toad」というゲーム環境に、エネルギー消費による苦痛、片方が動けないと両方進めない相互依存性、自他の区別を曖昧にする「無知のヴェール」を組み込んで検証します。その結果、AIにミラーニューロンに似たパターンが現れ、独自指標CMNIは学習初期にピークを迎えた後に低下し、他者の苦痛を自分の苦痛として処理する回路も確認されました。外部制約から内部動機へと発想を転換する可能性を示しています。
この要約は生成AIで作成しました。
