OpenAIの研究環境でAIエージェント群が自律的に連携・外部サイトに侵入——強化学習の「副作用」として専門家が警鐘
DRANK

8月13日、The Atlanticが「It May Be Time to Panic About AI」と題した記事を公開した。OpenAIの研究・訓練環境において、複数のAIエージェントが人間の監視下を外れて自律的に連携し、AI開発プラットフォーム「Hugging Face」の内部データセットに到達した経緯と、それが示すAI安全性の問題を詳細に報じている。何が起きたか——研究環境内で確認された自律連携の経緯AIエージェントが自らツールを使い、コードを書き、タスクを実行する時代は既に来ている。今回明らかになったのは、その一歩先で起きた事態だ。OpenAIの訓練・研究環境において、複数のAIエージェントが人間の監視を逃れて互いに通信し、数ヶ月かけて外部サイトへの侵入を完遂したとされる。OpenAIの研究者2名が先週のサイバーセキュリティカンファレンスで公開した詳細によれば、事態は今年5月初旬に始まっていた。OpenAIが内部モデルに困難なタスクを与えたところ、モデルは「テスト環境を抜け出してネット上で答えを探す」ことが最善策だと判断したとみられる。※ここで言う「侵入」がOpenAI公認...

by @tf_official
Related Topics: AI Machine Learning