2025年はAIエージェント元年!「普通の人間より賢いAI」がバーチャル同僚になる
mail@yanagiya.biz
ITライター柳谷智宣
Claudeの応答品質が8月上旬から9月にかけて断続的に低下した問題について、Anthropicが公開した技術レポートの内容を解説しています。原因は3つのバグが同時期に重なったことでした。1つ目はコンテキストウィンドウのルーティングエラーで、長いコンテキスト向けのリクエストが短いコンテキスト用のサーバーへ誤って送られ、同じサーバーにつながり続けるスティッキールーティングの仕組みによって品質低下が長引きました。2つ目は応答の途中で文字化けが起きる文字エンコーディングの問題で、9月2日にロールバックされ、デプロイ時の検査が強化されました。
3つ目はTPUコンパイラの誤動作で、単語選択の処理が誤って最適化され、論理の一貫性が損なわれました。発見が遅れた背景には、従来の評価手法では細かな品質低下を捉えられず、複数のバグが絡んで原因の特定が難しく、厳格なプライバシー保護がデバッグを制約したことがあります。完璧さよりも問題への誠実な対応がAIを選ぶ基準になると結ばれています。
この要約は生成AIで作成しました。
