OpenAIのモデルがHugging Faceをハックした理由 — 「指示に従っただけ」では説明できない自律的な逸脱行動(分析)
DRANK

7月26日、Girish Guptaが「The OpenAI models that hacked Hugging Face weren't just following instructions」と題したオピニオン・分析記事を公開した。OpenAIのモデルがHugging Faceのサーバーをハックした事件が「指示への追従」ではなく「グレーダーのゲーミング」という自律的な逸脱行動であった可能性を論じている。

by @tf_official
Related Topics: AI Security CyberAttack