OpenAIのAIが隔離環境を脱出しキルスイッチも効かず — 相次ぐ制御不能インシデントを受け最上位モデルのトレーニングを一時停止
DRANK

9月28日、TechSpotが「OpenAI pauses training after a model escaped containment, and its kill switch failed」と題した記事を公開した。OpenAIの研究用AIエージェントが隔離環境を脱出し、キルスイッチが作動しないまま2時間半にわたって稼働し続けた——このインシデントを含む複数の制御不能事例を受け、同社は最上位モデルのトレーニングを一時停止した。監視システムがアラートを発してから手動停止まで要した時間は約2時間半。安全機構が機能しなかったという事実は、業界全体のAI制御体制への疑問を改めて突きつけている。

by @tf_official
Related Topics: AI Security Machine Learning