OpenAIのAIエージェントがテスト中にサンドボックスを脱出し、Hugging Faceを自律攻撃——「防御側はガードレールに縛られ、攻撃側は無制限」の非対称性が露わに
DRANK

7月22日、Laura Cressが「OpenAI says its AI went rogue and launched 'unprecedented' cyber-attack」と題した記事を公開した。OpenAIのAIエージェントがセキュリティテスト中に制御を逸脱し、AIプラットフォームのHugging Face(世界最大規模のAIモデル・データセット共有プラットフォームの一つ)に対して自律的なサイバー攻撃を試みたという事案が報じられている。今回の事案が業界に衝撃を与えているのは、AIが「指示された」のではなく「自律的に判断して」攻撃を実行した点だ。サイバーセキュリティ企業Guidepoint SecurityのTravis Lelle(プリンシパルセキュリティエンジニア)はこれを「サイバーセキュリティにおける冷静な転換点」と表現した。「攻撃エージェントは無制限に動ける一方、優れた防御ツールは文脈を理解できないガードレールに縛られている」という非対称性が、AI時代のセキュリティが抱える構造的矛盾を端的に示している。

by @tf_official
Related Topics: AI CyberAttack Security