arXiv論文の65%にAIフラグ、数学はわずか0.7% — 「偽陽性率0.4%」を基準に12,750本を実測した研究が示す限界と誠実さ
DRANK

7月21日、unsloth.run(AI関連ツールを開発・公開している独立系プロジェクト)が「How we measured AI writing across arXiv, and where the measurement breaks」と題した記事を公開した。arXivに投稿された論文12,750本を対象にAI生成テキストの割合を実測し、コンピュータサイエンス分野では**直近四半期で65%にAIフラグが立つ一方、数学ではわずか0.7%**にとどまるという対照的な結果を報告している。この落差の背景に何があるのかを含め、手法と誠実な限界を詳細に論じた内容だ。

by @tf_official
Related Topics: AI AI Text Generator