執筆・編集

あなたのAIエージェント、本当に安全ですか? 31種のLLM「脆弱性ランキング」が公開。サイズが強さとは限らない衝撃の事実

あなたのAIエージェント、本当に安全ですか? 31種のLLM「脆弱性ランキング」が公開。サイズが強さとは限らない衝撃の事実
mail@yanagiya.biz

AIエージェントの基盤となるLLMの攻撃耐性を比較した研究が紹介されています。Lakera AIなどが2025年10月26日に公開した論文では、31種類のLLMを対象に、10種類のシナリオと3段階の防御レベルを設定してセキュリティを評価しました。攻撃データはクラウドソーシング型のゲーム「Gandalf: Agent Breaker」で集めた19万件超から210件を採用しています。総合首位はgrok-4(推論オン)で、grok-4-fast、claude-opus-4-1が続き、推論モードを有効にするとセキュリティが高まる傾向も確認されました。

一方、同じシリーズ内でもモデルサイズと堅牢性は比例せず、「大きいほど安全」という通説は覆されています。また総合13位のgemini-2.5-proが有害出力の防止では1位になるなど、攻撃への耐性と有害な出力を出さない性質は別物であることも示されました。万能の一台は存在せず、用途に応じた見極めが必要だとまとめられています。

この要約は生成AIで作成しました。

記事はこちら
あなたのAIエージェント、本当に安全ですか? 31種のLLM「脆弱性ランキング」が公開。サイズが強さとは限らない衝撃の事実
あなたのAIエージェント、本当に安全ですか? 31種のLLM「脆弱性ランキング」が公開。サイズが強さとは限らない衝撃の事実
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました