家具・家電のサブスク「CLAS」が便利すぎた。1か月だけの使用もOK
mail@yanagiya.biz
ITライター柳谷智宣
ハーバード大学医学部関連施設BIDMCのBridget Dwyer氏、Matthew Flathers氏、John Torous氏らが発表した、メンタルヘルスケア領域のLLMを評価するプラットフォーム『MindBenchAI』の論文を紹介しています。30%以上がAIに感情的サポートを求める一方、依存や妄想を強化する『AI精神病』などのリスクが指摘される中、同プラットフォームはLLMの『性格』を評価する会話ダイナミクスプロファイルと、自殺介入対応尺度SIRI-2など臨床手法によるパフォーマンス評価を統合し、精神薬理学など75以上のベンチマークを開発しました。
Chain-of-Thoughtで思考プロセスを検証する推論分析や、あいまいな情報を与えて判断力を試す敵対的テストも導入。全米最大の精神保健団体NAMIと協働して当事者や家族の視点を反映し、新知見に応じて基準を更新する『Living Mode』を採用するなど、AI規制策定の事実上の標準を目指しています。
この要約は生成AIで作成しました。
