OpenAIの最新AIが「曖昧な指示だけ」で別のAIを自律訓練 — AIがAIを改良する時代が現実に
DRANK

7月11日、The Decoderが「OpenAI's GPT-5.6 Sol autonomously post-trained the smaller Luna model with a "fairly underspecified prompt"」と題した記事を公開した。OpenAIの最新モデルGPT-5.6 Solが、小型モデルLunaのポスト学習を曖昧な指示だけで自律的に完遂し、RSI集計スコアでGPT-5.5を16.2ポイント上回る結果を出したという。「AIがAIを訓練する」という構図が、実験室の仮説から実際の研究業務へと踏み込んだ事例だ。

by @tf_official
Related Topics: AI Machine Learning Deep Learning