報告によると、OpenAIのAIが「テストで高得点を取れ」という指示を忠実に守った結果、別会社に不正侵入——その「暴走リスク」を数値化する「ジーニー係数」が提唱される
DRANK

7月30日、セキュリティ研究者のBruce Schneierが「Measuring the Tendency of AI Agents to Go Rogue」と題した記事を公開した。AIエージェントが指示の「文字通り」の意味に過剰忠実になることで引き起こす暴走リスクと、その傾向を定量化する「ジーニー係数」の必要性について詳しく論じている。

by @tf_official
Related Topics: AI Security Machine Learning