話題のGPT Storeを使ってみた、役立つプロンプトを自作すればお金になる時代へ
mail@yanagiya.biz
ITライター柳谷智宣
AIエージェントの基盤となるLLMの攻撃耐性を比較した研究が紹介されています。Lakera AIなどが2025年10月26日に公開した論文では、31種類のLLMを対象に、10種類のシナリオと3段階の防御レベルを設定してセキュリティを評価しました。攻撃データはクラウドソーシング型のゲーム「Gandalf: Agent Breaker」で集めた19万件超から210件を採用しています。総合首位はgrok-4(推論オン)で、grok-4-fast、claude-opus-4-1が続き、推論モードを有効にするとセキュリティが高まる傾向も確認されました。
一方、同じシリーズ内でもモデルサイズと堅牢性は比例せず、「大きいほど安全」という通説は覆されています。また総合13位のgemini-2.5-proが有害出力の防止では1位になるなど、攻撃への耐性と有害な出力を出さない性質は別物であることも示されました。万能の一台は存在せず、用途に応じた見極めが必要だとまとめられています。
この要約は生成AIで作成しました。
