自己改善AIが「テストの丸暗記」に陥る問題をGoogleが解決 — 訓練スコアより汎化性能を優先する設計で未知タスクの全ベースラインを上回る
DRANK

10月4日、The Decoderが「Google researchers find a way to keep self-improving AI agents from memorizing their tests」と題した記事を公開した。この記事では、自己改善型AIエージェントがテストタスクを「丸暗記」してしまう問題を、Googleの研究者がRRSIという手法で解決したことについて詳しく紹介されている。

by @tf_official
Related Topics: AI Machine Learning Deep Learning