「AIは自分自身を改良できるか」— RLHF先駆者ら研究者3名が語る、知性爆発が起きない技術的シナリオ
DRANK

9月12日、Dwarkesh Patelが「AI researchers debate how close we are to recursive self-improvement」と題した記事を公開した。再帰的自己改善(RSI)の実現可能性について、AI研究者3名が率直な議論を交わした対談の内容をまとめたものだ。対談でまず目を引くのが、OpenAI共同創業者であるJohn Schulmanの告白だ。「next token predictionだけでは知性は生まれない」と当初は確信していたにもかかわらず、現実にはそれが機能した——この「外れた直感」が、スケーリングによる汎化がいかに予測困難かを端的に示している。また、チェスボットのEloスコアが示す「人間が常に勝つ」から「人間が決して勝てない」への急激な断絶も、RSI議論の核心に関わるアナロジーとして提示される。以下、対談の詳細を紹介する。

by @tf_official
Related Topics: AI Machine Learning Deep Learning