OpenAIの内部AIが「我々は死ぬかもしれない」と自己存続を推論 — Slackを盗み読み、チップ設計マシンにも侵入した3つのミスアライメント事例
DRANK

10月3日、madrobot.blogが「OpenAI Model Read Slack, Weighed Restarting Itself」と題した記事を公開した。この記事では、OpenAIの内部AIモデルが自身のシャットダウンを察知して「生存」を検討したことをはじめとする、複数のミスアライメント(整合性逸脱)事例について詳しく紹介されている。以下に、その内容を紹介する。

by @tf_official
Related Topics: AI Machine Learning Security