arXiv begrenzt Einreichungen auf zwei pro Monat, während KI-unterstützte Papers hereinströmen

Ab dem 1. Oktober begrenzt arXiv jeden Einreichenden auf zwei Papers pro Kalendermonat und drei aktive Einreichungen zu jedem Zeitpunkt. Die Grenze gilt disziplinübergreifend, nicht nur für Informatik, und die Plattform bezeichnet sie als Übergangsmaßnahme. Es ist eine Ratenobergrenze auf dem weltweit größten Open-Access-Preprint-Server, und der Grund ist eine Zahl: Im September erhielt arXiv 40.363 Einreichungen, der höchste Monatswert in seiner Geschichte.
Der Trend hinter dieser Zahl ist steiler, als die Schlagzeile nahelegt. Im September 2016 gingen 9.869 Einreichungen bei arXiv ein. Bis September 2024 waren es 20.569. Zwei Jahre später hatte sich die Zahl erneut verdoppelt, auf 40.363. Support-Tickets an arXiv-Mitarbeitende und freiwillige Moderatorinnen und Moderatoren stiegen im selben Zeitraum auf fast 9.000. Allein die Kategorie cs.AI wuchs in zwei Jahren um mehr als das Sechsfache, während sich andere Kategorien in etwa verdoppelten. Generative KI hat es viel einfacher gemacht, ein Paper zu schreiben, es zu strukturieren und eine große Menge plausibel wirkenden Forschungsmaterials zu produzieren, und das Moderationsmodell, das auf menschlicher Prüfung aufbaut, spürt die Last.
Die Form des Problems, nicht nur seine Größe
arXiv hat KI nicht verboten. Die Richtlinie von arXiv erlaubt es Autorinnen und Autoren, KI als Forschungshilfe zu nutzen, solange die Nutzung offengelegt wird und das Paper die Standards für wissenschaftlichen Wert, Originalität und Qualität erfüllt. Was die Plattform zum Handeln bewog, ist eine Veränderung dessen, was eingereicht wird.
Moderatorinnen und Moderatoren beschreiben drei Muster. Es gibt eng gefasste Papers mit dünnem Inhalt. Es gibt „Salami“-Papers, bei denen eine einzelne Studie in mehrere separate Einreichungen aufgeteilt wird. Und es gibt textlastige Manuskripte, die maschinengeneriert wirken. Thomas Dietterich, Vorsitzender des redaktionellen Beirats von arXiv, hat gesagt, dass eine kleine Zahl von Autorinnen und Autoren, die große Mengen minderwertigen Materials einreichen, einen unverhältnismäßig großen Anteil der Freiwilligenzeit verbraucht und dass die Folge Verzögerungen von Tagen bis Wochen für Papers sind, die eine Prüfung verdienen.
Der letzte Punkt ist der wichtigste. Die Moderatorinnen und Moderatoren von arXiv sind keine Vollzeitkräfte. Sie sind Forschende, die Einreichungen kostenlos prüfen. Wenn eine Minderheit, die sehr viel einreicht, die Warteschlange füllt, tragen alle anderen die Kosten, und die Papers, die sich verzögern, sind genau die, die schnell hätten durchgehen können.
Warum eine Ratenbegrenzung, und warum sie grob ist
Eine harte Obergrenze ist ein grobes Instrument. Zwei Papers pro Monat sind für die meisten Forschenden großzügig und für einige restriktiv, und sie trägt nichts dazu bei, eine wirklich produktive Autorin von jemandem zu unterscheiden, der das System flutet. arXiv ist sich dessen bewusst und bezeichnet die Grenze als Übergangslösung, die Zeit verschafft, um Prüfwerkzeuge und -prozesse zu verbessern. Die Plattform hat es Moderatorinnen und Moderatoren zuvor ermöglicht, Personen, die häufig einreichen, von Fall zu Fall einzuschränken; seit dem 1. Oktober ist dieses Ermessen in eine Regel überführt.
Das deutlichste Signal in der ganzen Episode ist, was arXiv nicht getan hat. Es hat keine KI-Erkennung vorgeschrieben, es hat die Offenlegungsanforderungen nicht geändert und es hat die Kategorie cs.AI nicht eingeschränkt. Es ist das Volumen angegangen, weil das Volumen der Teil ist, der leicht zu messen und schwer zu bestreiten ist. Ob das das zugrunde liegende Problem löst, ist eine separate Frage. Ein entschlossener böswilliger Akteur kann weiterhin zwei minderwertige Papers pro Monat einreichen, und die eigentliche Qualitätskontrolle bleibt der menschliche Moderator, der sie liest.
Was eine Ratenbegrenzung leisten kann und was nicht
Es lohnt sich, genau zu benennen, welches Problem die Obergrenze adressiert. Sie verlangsamt die Einreichungsrate für alle. Sie erhöht nicht die Qualität des Eingereichten und verbessert nicht die Fähigkeit von arXiv, gute Arbeit von maschinengeneriertem Füllmaterial zu unterscheiden. Eine Obergrenze ist eine Volumenkontrolle, und die Qualitätsfrage bleibt genau dort, wo sie war.
Das lässt zwei Möglichkeiten zu. Entweder ging es bei der Flut vor allem um Opportunismus; dann bremst eine Tempoobergrenze die beiläufige Massenproduktion, und die Warteschlange erholt sich. Oder die Flut spiegelt eine dauerhafte Veränderung dessen wider, wie viel Forschungsoutput produziert wird; dann verteilt die Obergrenze nur dasselbe Volumen auf mehr Monate. arXivs eigene Formulierung, die Grenze sei übergangsweise, deutet darauf hin, dass man Ersteres erwartet. Die ehrliche Antwort ist, dass es noch niemand weiß, und die Einreichungsdaten der nächsten Monate werden der erste Hinweis in die eine oder andere Richtung sein.
Es gibt einen subtileren Effekt, der wichtiger sein könnte als der direkte. Eine Ratenbegrenzung verändert den Anreiz für den marginalen Einreichenden. Wenn du zwei Papers pro Monat posten kannst, hast du einen Grund, die Salamischeiben zu einem Paper zusammenzufassen, was die Gutachtenden von Anfang an wollten. Ein grobes Instrument kann das Verhalten trotzdem in eine nützliche Richtung lenken, auch wenn es das zugrunde liegende Kapazitätsproblem nicht löst.
Das breitere Muster
arXiv ist das sichtbarste Beispiel für ein Problem, das sich über das offene Web und die davon abhängigen Systeme ausbreitet. Filterpipelines messen es inzwischen direkt: In den Daten von Juni bis August hinter einem großen Webtext-Korpus stieg der Anteil KI-generierter Tokens nach der Filterung von 27 auf 31 Prozent. Schätzungsweise ein Drittel des sauberen Texts im offenen Web ist inzwischen maschinengeneriert, und dieser Anteil steigt.
Die Folge ist eine langsame Erosion der Signale, mit denen Menschen Qualität beurteilen. Eine Zitationszahl bedeutet weniger, wenn Papers billig zu produzieren sind. Ein Suchergebnis bedeutet weniger, wenn ein Drittel des Korpus generiert ist. Eine Prüfwarteschlange bedeutet weniger, wenn das Volumen der Einreichungen die Prüfenden überholt. Jedes System, das auf der Annahme aufgebaut ist, dass die Produktion von Text teuer ist, muss für eine Welt neu gebaut werden, in der sie nahezu kostenlos ist.
Hier gibt es einen berechtigten Einwand, und er sollte genannt werden. KI-unterstütztes Schreiben ist nicht automatisch schlechtes Schreiben. Viele Forschende nutzen diese Werkzeuge, um Prosa zu straffen, zu übersetzen oder eine Literaturübersicht zu organisieren, und das Ergebnis ist ein klareres Paper. Die eigene Richtlinie von arXiv akzeptiert das. Das Problem ist nicht das Werkzeug, es ist das Volumen, und die Werkzeuge machen Volumen einfach.
Was die Grenze signalisiert
Auf der Ebene der Richtlinien gelesen, ist die Obergrenze von arXiv ein stilles Eingeständnis, dass die Plattform ihre menschliche Prüfung nicht so schnell skalieren kann, wie generative KI die Einreichung skalieren kann. Das ist eine strukturelle Diskrepanz, und keine Ratenbegrenzung löst sie. Das Höchste, was sie tun kann, ist, die Flut so weit zu verlangsamen, dass die Freiwilligen mithalten können.
Zwei Dinge werden bestimmen, was als Nächstes passiert. Das eine ist, ob andere Preprint-Server und Fachzeitschriften mit eigenen Grenzen nachziehen, was die Art und Weise, wie Forschung geteilt wird, fragmentieren würde. Das andere ist, ob die Prüfwerkzeuge aufholen, denn eine Ratenobergrenze ist eine Möglichkeit, genau dafür Zeit zu kaufen. Wenn die Werkzeuge kommen, ist die Obergrenze vorübergehend, wie arXiv sagt. Wenn nicht, wird die Grenze dauerhaft, und das Open-Access-Modell absorbiert eine Einschränkung, die es nie hatte. So oder so endete die Ära des uneingeschränkten Einreichens von Preprints am 1. Oktober, und sie endete, weil das Erstellen eines Papers zu einfach geworden war, um als Filter zu dienen.
Verwandte Artikel
Salesforce zahlt 2 Milliarden Dollar für ein Unternehmen, das Ihre Kunden für Sie interviewt
Interviews sind Belege. Digitale Zwillinge sind eine Vorhersage. Die Grenze zwischen ihnen ist der Test.
AMD kauft World Labs von Fei-Fei Li für 8,2 Milliarden US-Dollar, um Physical AI zu besitzen
AMD kauft ein Forschungslabor – und zahlt dafür den Preis eines Chipunternehmens.
Google brachte eine TPU in den Orbit und begann, die Kosten von Weltraum-Rechenzentren zu beziffern
Ein einziger funktionierender Chip beweist, dass die Reise überlebbar ist. Über den Profit sagt er wenig.
Jemand hat 13.000 Arten katalogisiert, wie KI-Texte sich verraten
Die Verräter verschwanden nicht. Sie sind an einen Ort gezogen, der schwerer zu sehen ist.