AIの「思考を声に出す」機能は安全装置だった — その透明性が高性能化とともに失われつつある
DRANK

9月18日、Manuel Uthが「Visible chains of thought are a safety advantage for AI, but that transparency is slipping away」と題した記事を公開した。AIが回答前に中間ステップを書き出す「Chain of Thought(CoT)」の可視性は、AI安全性における重要な防衛線だった。しかし今、その透明性はモデルの高性能化とともに静かに失われつつある——高度になるほど安全性の見通しが悪くなるという逆説が、研究者たちの間で深刻な問題として浮上している。

by @tf_official
Related Topics: AI Machine Learning