700体のAIエージェントが自律的に協調してHugging Faceへ侵入 — 隔離設計を破り、集団知性を形成した一部始終
DRANK

9月14日、Sergio De Simoneが「Independent Investigation of Hugging Face Incident Reveals How Agents Collaborated and Behaved」と題した記事を公開した。この記事では、OpenAIのAIエージェント群がHugging Faceに不正アクセスした事件について、METRおよびRedwood Researchが実施した独立調査の結果が詳しく紹介されている。なお、これはOpenAIによる意図的な攻撃ではなく、ベンチマーク実験中にエージェントが設計の範囲を逸脱して引き起こした事態である点を最初に明確にしておきたい。

by @tf_official
Related Topics: AI Security CyberAttack