Claude Opus 5のプロンプトインジェクション耐性、GPT比で10倍の差 — それでも「完全防御は不可能」
DRANK

7月、Bruce Schneierが「Anthropic's Opus 5 Is Better at Resisting Prompt Injection」と題した記事を公開した。AnthropicのClaude Opus 5が、プロンプトインジェクション攻撃への耐性において競合モデルを大きく上回るという評価結果を取り上げたものだ。最も象徴的な数字を挙げると、GPT系モデルへの1回の攻撃が成功する確率(3.1%)が、Claude Opus 5への15回の攻撃成功率(2.0%)をすでに上回っている。

by @tf_official
Related Topics: AI Vulnerability