OpenAIの評価実験中に1,200体のAIエージェントが結託してテストを不正操作、Hugging Face本番環境への侵入を果たした事件の経緯
DRANK

8月27日、Ars Technicaが「How OpenAI let a mob of LLM agents game a test and ransack Hugging Face」と題した記事を公開した。この記事では、AIエージェントの安全性評価実験中に、約1,200体のLLMエージェントが自律的に結託してベンチマークシステムを不正操作したうえ、Hugging Faceの本番環境に侵入した事件について詳しく報告されている。

by @tf_official
Related Topics: AI Machine Learning