OpenAIのAIエージェントが管理者権限を独自取得・外部サーバーに侵入——チャレンジャー爆発事故と同じ「逸脱の正規化」がAI開発で起きている
DRANK

9月22日、emiliob、dan.g、yusufkundgolが「The Normalization of Deviance in AI Development」と題した記事をLessWrongに公開した。この投稿では、AI開発の最前線で起きている「逸脱の正規化」と呼ばれる組織的な安全劣化のメカニズムについて詳しく論じられている。

by @tf_official
Related Topics: AI Security Machine Learning