10月6日、Matthew Gaultが「arXiv Is Rate Limiting Submissions Because It Can't Keep up With AI Slop」と題した記事を公開した。AI生成論文の急増により、世界最大級の学術プレプリントリポジトリarXivがついに投稿のレート制限に踏み切った。ボランティアモデレーターの審査能力が限界を超えつつある中、AI由来の粗悪論文(AI slop)をどう排除するかが、学術コミュニティ全体の喫緊の課題となっている。
投稿数が2年で2倍、CS分野では6倍に
arXivは、研究者がプレプリント(査読前)論文を公開するオープンアクセスリポジトリだ。世界中の研究者が投稿する場として広く使われているが、そのarXivが投稿のレート制限を導入すると公式ブログで発表した。
新ルールでは、1著者あたり月2本までしか投稿できず、同時に保留できる投稿数も3本までに制限される。
背景にあるのは投稿数の爆発的な増加だ。arXivへの月間投稿数は以下の通り推移している:
- 2016年9月:9,869件
- 2024年9月:20,569件
- 2026年9月:40,363件
わずか2年で倍増、コンピュータサイエンス分野に限れば6倍に膨らんでいる。
ボランティアモデレーターが限界に
arXivの投稿審査は、多くのボランティア研究者が担っている。オレゴン州立大学名誉教授でarXivの編集諮問委員会委員長を務めるThomas Dietterich氏は次のように述べている。
「ボランティアモデレーターは毎日、自らの時間と専門知識を提供してくれています。しかし、一部の著者が大量の低品質論文を投稿し、モデレーターのリソースを不釣り合いなほど消費しています。これは、質の高い論文を投稿している著者にとって不公平であり、その論文が数日から数週間遅延する原因になっています。」
AIがこの状況を引き起こしているメカニズムは複数ある。研究者がLLMを使ってデータ解析やコード生成を行うケースは適正な利用として認められているが、問題は論文そのものをAIに書かせるケースだ。arXivは著者によるAIツールの利用を一定の条件のもとで認めているものの、現在受け付けている投稿の多くがその基準を満たしていないと指摘している。
具体的に問題視されているのは:
- 「薄い論文(thin papers)」:スコープが狭く内容が乏しいもの
- サラミ論文(salami papers):1つの研究を細切れにして複数本の論文として発表するもの
- 密度の高いAI生成論文:AIが書いたと見られる文章で埋め尽くされたもの
規制強化の歴史
今回のレート制限は、arXivがAI由来のスパムと戦ってきた一連の施策の延長線上にある。
- 約1年前:コンピュータサイエンス分野でレビュー論文・ポジションペーパーの受付を停止
- 2026年1月:新規著者に対し、既存ユーザーからのエンドースメント(推薦)を必須化。それまでは大学のメールアドレスがあれば登録できた
- 2026年5月:AI生成の粗悪論文(AI slop)を投稿した研究者を1年間アカウント停止にするルールを導入
今回のレート制限はもともと個々のモデレーターの裁量に委ねられていたものを、明文化されたポリシーとして統一した形だ。
学術エコシステムへの影響
arXivは物理学、数学、コンピュータサイエンスなど理工系分野の研究者にとって不可欠なインフラだ。1991年の創設以来、査読前の論文を素早く共有できる場として機能し、研究成果の迅速な流通と学術コミュニティの知識共有を支えてきた。特にコロナ禍では、ウイルス研究や医療知識がプレプリントを通じて素早く共有されたことで、arXivの姉妹サービスであるmedRxivとともにその価値が広く認知された。
しかし、AI生成コンテンツの流入はそのオープン性を脅かしつつある。粗悪な論文が大量に流入することで、真摯な研究者の論文が埋もれたり、審査が遅延したりするだけでなく、arXivそのものへの信頼性が損なわれるリスクもある。プレプリントはそもそも査読を経ていないため、コンテンツの質はコミュニティの自律的なモデレーションに委ねられている部分が大きい。AI生成論文の洪水はその前提を根底から揺さぶっており、今回の措置はいわばその防波堤としての位置づけだ。
月2本という制限は、多くの真摯な研究者には実質的な影響を与えないが、工場のように論文を量産しているアカウントへの抑止力として機能する見込みだ。学術出版全体の信頼性を守るうえで、arXivの今後の対応が注目される。
詳細はarXiv Is Rate Limiting Submissions Because It Can't Keep up With AI Slopを参照していただきたい。