arXiv、AI支援論文の流入を受け投稿を月2本に制限

10月1日から、arXivはすべての投稿者に対し、暦月あたり2本の論文、および常時3件のアクティブな投稿という制限を設ける。この制限はコンピュータサイエンスだけでなく全分野に適用され、プラットフォームはこれを暫定的な措置と呼んでいる。世界最大のオープンアクセス・プレプリントサーバーに対する投稿頻度の上限であり、その理由はある数字にある。9月にarXivは40,363件の投稿を受け取り、これは史上最高の月間総数だった。
この数字の背景にある傾向は、見出しが示すよりも急峻だ。2016年9月、arXivが受け取った投稿は9,869件だった。2024年9月には20,569件。さらに2年後には倍増して40,363件となった。同じ期間に、arXivのスタッフとボランティアのモデレーターに宛てられたサポートチケットは約9,000件にまで増えた。cs.AIカテゴリだけで2年間に6倍以上に増加し、他のカテゴリもほぼ倍増した。生成AIは、論文を書き、構成し、もっともらしく見える研究資料を大量に生み出すことをはるかに容易にした。そして、人間によるレビューを前提に構築されたモデレーションモデルが負荷を感じている。
問題の規模だけでなく、その形
arXivはAIを禁止していない。そのポリシーは、使用が開示され、論文が学術的価値、独創性、品質に関する基準を満たす限り、著者が研究補助としてAIを使うことを認めている。プラットフォームを行動に駆り立てたのは、投稿されるものの中身の変化だ。
モデレーターは3つのパターンを挙げている。内容の薄い狭い範囲の論文。1つの研究を複数の別々の投稿に切り分けた「サラミ」論文。そして、機械生成されたように読めるテキスト中心の原稿だ。arXivの編集諮問委員会の委員長を務めるトーマス・ディータリッヒは、少数の著者が大量の低品質な素材を投稿することで、ボランティアの時間が不釣り合いに消費され、その結果、レビューに値する論文が数日から数週間遅れると述べている。
最後の点が最も重要だ。arXivのモデレーターは専任スタッフではない。彼らは無償で投稿をレビューする研究者である。少数の大量投稿者が列を埋めると、そのコストは他の全員にのしかかり、遅れるのは、本来ならすぐに通っていたはずの論文なのだ。
なぜ投稿頻度制限なのか、そしてなぜそれは強引なのか
厳格な上限は粗い道具だ。月2本という数はほとんどの研究者にとって寛大で、少数にとっては制約的であり、本当に多作な著者とシステムに大量投稿している人を区別する効果はない。arXivはそれを認識しており、この制限を、レビューツールとプロセスを改善する時間を稼ぐための暫定措置と位置づけている。プラットフォームは以前、モデレーターが高頻度投稿者を個別に制限できるようにしていた。10月1日から、その裁量はルールとして標準化される。
この一件で最も明確なシグナルは、arXivがやらなかったことだ。AI検出を義務づけず、開示要件も変更せず、cs.AIカテゴリも制限しなかった。標的にしたのは量である。量は測定が容易で、反論しにくい部分だからだ。それで根本的な問題が解決するかは別問題だ。悪意ある人物が決意すれば、今でも月に低品質な論文を2本投稿できる。品質を本当にチェックするのは、それらを読む人間のモデレーターであり続ける。
投稿頻度制限にできること、できないこと
この上限がどの問題に対処しているのかは正確に押さえておく価値がある。それは全員の投稿ペースを遅くする。投稿されるものの品質を高めるわけでも、優れた研究と機械生成の埋め草を見分けるarXivの能力を改善するわけでもない。上限は量の制御であり、品質の問題はまったく元の場所にとどまっている。
すると2つの可能性が残る。洪水が主に日和見主義によるものなら、ペース制限は安易な粗製濫造を抑え、キューは回復する。あるいは、洪水が研究生産量の持続的な変化を反映しているなら、上限は同じ量をより多くの月に分散させるだけだ。arXiv自身がこの制限を暫定的と呼んでいることは、前者を予想していることを示唆する。正直なところ、まだ誰にもわからない。今後数カ月の投稿データが、どちらなのかを示す最初の証拠になるだろう。
直接的な効果よりも重要な、より微妙な効果がある。投稿頻度制限は、限界的な投稿者のインセンティブを変える。月に2本しか投稿できないなら、サラミの切片を1本の論文にまとめる理由が生まれる。それはまさにレビュアーが最初から望んでいたことだ。強引な道具でも、根底にあるキャパシティ問題を解決しないまでも、行動を有用な方向へ促すことはできる。
より広いパターン
arXivは、オープンウェブとそれに依存するシステム全体に広がる問題の、最も目に見える事例だ。フィルタリングパイプラインは今やそれを直接測定している。ある主要なウェブテキストコーパスの6月から8月のデータでは、フィルタリング後のAI生成トークンの割合が27%から31%に上昇した。オープンウェブ上のクリーンなテキストのおよそ3分の1が機械生成であると現在推定されており、その割合は上昇している。
その結果として、人々が品質を判断するために使うシグナルが徐々に侵食されている。論文の生産が安価になれば、引用数の意味は薄れる。コーパスの3分の1が生成されたものであれば、検索結果の意味は薄れる。投稿量がレビュアーを上回れば、レビューキューに入っていることの意味は薄れる。テキストの生産にコストがかかるという前提で築かれたあらゆるシステムは、それがほぼ無料になった世界に向けて作り直さなければならない。
ここには正当な異論があり、それは述べておく価値がある。AI支援の執筆が自動的に悪い文章になるわけではない。多くの研究者がこれらのツールを、文章を引き締めたり、翻訳したり、文献レビューを整理したりするために使っており、その結果として論文はより明確になる。arXiv自身のポリシーもそれを認めている。問題はツールではなく量であり、ツールが量を容易にしているのだ。
この制限が示すもの
政策のレベルで読めば、arXivの上限は、プラットフォームが人間によるレビューを、生成AIが投稿を拡大する速さと同じだけ拡大できないことの静かな認めである。これは構造的なミスマッチであり、どのような投稿頻度制限でも解決しない。最大限できるのは、ボランティアが追いつける程度に洪水を遅らせることだ。
次に何が起きるかを決めるのは2つのことだ。1つは、他のプレプリントサーバーやジャーナルが同様の制限を導入するかどうかであり、そうなれば研究共有のあり方が分断される。もう1つは、レビューツールが追いつくかどうかだ。投稿頻度の上限は、まさにそのための時間を稼ぐ手段だからである。ツールが登場すれば、arXivが言うように上限は一時的だ。登場しなければ、制限は恒久化し、オープンアクセスモデルはこれまでになかった制約を抱え込むことになる。いずれにせよ、プレプリント投稿の自由放任時代は10月1日に終わった。そしてそれは、論文を作ることがフィルターとしてあまりにも容易になりすぎたから終わったのだ。
関連記事
ウォーターマークは偽物に追いつけていない
システムは機能している。網羅性は機能していない。その隙間は、視聴者が想定する何かによって埋められている。
あなたのAIエージェントが今、カスタマーサポートに電話をかけている——企業は対応を迫られている
権限のない要求に対する完璧な音声は、検証済みの要求に対するぎこちない音声よりも悪い。
Reddit、最後の開かれた扉を閉ざし、スクレイパーのせいにする
Redditがライセンスしていないスクレイパーは不正利用である。Redditがライセンスしたスクレイパーは収益である。
イングランド銀行、AIの債務を金融安定リスクとして正式に織り込む
利益剰余金で賄われたブームは非公開で解消できる。このブームは4,500億ドルの新規債務で動いている。