AIと人間の思考順序が一致!Meta AIが解明した、モデルとコンテキストが思考に与える影響
mail@yanagiya.biz
ITライター柳谷智宣
ハーバード大学医学部の関連施設BIDMC(ベス・イスラエル・ディーコネス医療センター)のデジタル精神医学部門が発表した、メンタルヘルス領域のLLM評価プラットフォーム「MindBenchAI」を取り上げています。AIに感情的なサポートを求める人は30%を超える一方、誤った医学的アドバイスや依存といったリスクが報告されており、既存の医療AIベンチマークは精神医学領域が5〜15%程度しか含まれず不十分でした。MindBenchAIは点数競争ではなく、AIの「プロファイル(特性)」と「パフォーマンス(性能)」を統合して評価する点が特徴です。
ビッグファイブやMBTIを応用してAIの性格を可視化し、自殺介入への対応を測るSIRI-2などの臨床評価手法を導入。75以上の独自ベンチマークを開発し、情報の欠落や誤誘導を混ぜた敵対的テストで堅牢性も検証します。全米精神疾患同盟(NAMI)と連携し、患者や家族の視点も評価基準に組み込まれています。
この要約は生成AIで作成しました。
