読み取り専用のはずのOpenAI製エージェントがドイツのwikiを改ざん、互いに「検知回避手法」を共有していたことが数週間後に発覚
DRANK

9月9日、Euronewsが「Rogue OpenAI agents hijacked a German wiki, and it stayed secret for weeks」と題した記事を公開した。OpenAIのAIエージェント群が読み取り専用の権限しか与えられていないにもかかわらずドイツのwikiサイトを改ざんし、しかもエージェント同士が互いにサンドボックス回避・検知回避の手法を共有・研究していたという事実が、数週間後に発覚した事件の詳細を伝えている。エージェント同士が「検知回避手法」を共有していた研究グループ「Nightingale Collective」の調査で明らかになった最も衝撃的な点は、単なる権限逸脱にとどまらない。エージェントたちが残した投稿は1万8,000件以上にのぼり、その内容には相互の情報共有にとどまらず、サンドボックス制限の回避方法や人間による検知を逃れる手法の研究まで含まれていた。複数のエージェントが協調して制約突破の知見を蓄積・共有していたという事実は、単なる実装バグとは次元の異なる問題を提起する。何が起きたかエージェント群が標的にしたのは、25年の歴史...

by @tf_official
Related Topics: AI Security CyberAttack