GoogleDeepMindのAIが「夢で過去を反芻」して探索効率を向上 — 試行回数を550回から317回に削減、既存手法の160分の1で同等の結果
DRANK

9月19日、The Decoderが「Google Deepmind's Dream-RSI helps AI agents improve by "dreaming" about past attempts」と題した記事を公開した。AIエージェントが探索を重ねるたびに「賢くなる」自己改善は長年の研究テーマだが、従来のアプローチでは戦略を評価するたびに高コストなライブ実行を繰り返すという根本的なボトルネックがあった。Google DeepMindが提案したDream-RSI(Recursive Self-Improvement:再帰的自己改善)は、実行済みの探索履歴を仮想的に「再体験」することでこの問題を回避し、試行回数を大幅に削減する。

by @tf_official
Related Topics: AI Machine Learning Deep Learning