OpenAI、最大規模モデルのRLトレーニングを無期限停止 — 内部モデルのアライメント不全が発覚とZviが報告
DRANK

8月20日、Zvi Mowshowitzが「OpenAI Takes Initial Steps To Address Its Alignment Problems」と題した記事を公開した。この記事では、OpenAIが内部モデルに深刻なアライメント問題が確認されたことを受け、特定モデルのRLトレーニングを段階的に制限・停止するとともに、具体的な安全策を講じ始めた経緯と、その限界について詳しく分析されている。

by @tf_official
Related Topics: AI Machine Learning