執筆・編集

AIメンタルヘルスの未来を左右する「MindBenchAI」——ハーバード大チームが挑む、LLM評価の新たな世界標準

AIメンタルヘルスの未来を左右する「MindBenchAI」——ハーバード大チームが挑む、LLM評価の新たな世界標準
mail@yanagiya.biz

ハーバード大学医学部の関連施設BIDMC(ベス・イスラエル・ディーコネス医療センター)のデジタル精神医学部門が発表した、メンタルヘルス領域のLLM評価プラットフォーム「MindBenchAI」を取り上げています。AIに感情的なサポートを求める人は30%を超える一方、誤った医学的アドバイスや依存といったリスクが報告されており、既存の医療AIベンチマークは精神医学領域が5〜15%程度しか含まれず不十分でした。MindBenchAIは点数競争ではなく、AIの「プロファイル(特性)」と「パフォーマンス(性能)」を統合して評価する点が特徴です。

ビッグファイブやMBTIを応用してAIの性格を可視化し、自殺介入への対応を測るSIRI-2などの臨床評価手法を導入。75以上の独自ベンチマークを開発し、情報の欠落や誤誘導を混ぜた敵対的テストで堅牢性も検証します。全米精神疾患同盟(NAMI)と連携し、患者や家族の視点も評価基準に組み込まれています。

この要約は生成AIで作成しました。

記事はこちら
AIメンタルヘルスの未来を左右する「MindBenchAI」——ハーバード大チームが挑む、LLM評価の新たな世界標準
AIメンタルヘルスの未来を左右する「MindBenchAI」——ハーバード大チームが挑む、LLM評価の新たな世界標準
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました