← Volver al blog
Newsaprox. 7 min de lectura

arXiv limita los envíos a dos al mes ante la avalancha de artículos asistidos por IA

Publicado 2 oct 2026
arXiv limita los envíos a dos al mes ante la avalancha de artículos asistidos por IA

A partir del 1 de octubre, arXiv limita a cada remitente a dos artículos por mes calendario y tres envíos activos en cualquier momento. El límite se aplica a todas las disciplinas, no solo a las ciencias de la computación, y la plataforma lo califica como una medida transitoria. Es un tope de frecuencia en el mayor servidor de preprints de acceso abierto del mundo, y la razón es un número: en septiembre, arXiv recibió 40.363 envíos, el total mensual más alto de su historia.

La tendencia detrás de esa cifra es más pronunciada de lo que sugiere el titular. En septiembre de 2016, arXiv recibió 9.869 envíos. Para septiembre de 2024, eran 20.569. Dos años después se había vuelto a duplicar, hasta 40.363. Los tickets de soporte dirigidos al personal de arXiv y a los moderadores voluntarios ascendieron a casi 9.000 en el mismo periodo. Solo la categoría cs.AI creció más de seis veces en dos años, mientras que otras categorías aproximadamente se duplicaron. La IA generativa ha hecho mucho más fácil escribir un artículo, estructurarlo y producir un gran volumen de material de investigación de aspecto verosímil, y el modelo de moderación construido en torno a la revisión humana está sintiendo la carga.

La forma del problema, no solo su tamaño

arXiv no ha prohibido la IA. Su política permite a los autores usar la IA como ayuda a la investigación siempre que su uso se declare y el artículo cumpla con sus estándares de valor académico, originalidad y calidad. Lo que empujó a la plataforma a actuar es un cambio en lo que se está enviando.

Los moderadores describen tres patrones. Hay artículos de alcance limitado y contenido escaso. Hay artículos «salami», en los que un único estudio se divide en varios envíos separados. Y hay manuscritos con mucho texto que se leen como generados por máquina. Thomas Dietterich, presidente del consejo asesor editorial de arXiv, ha dicho que un pequeño número de autores que envían grandes volúmenes de material de baja calidad consume una porción desproporcionada del tiempo de los voluntarios, y que el resultado son retrasos de días a semanas para artículos que merecen revisión.

Ese último punto es el que más importa. Los moderadores de arXiv no son personal a tiempo completo. Son investigadores que revisan los envíos de forma gratuita. Cuando una minoría de remitentes de alto volumen llena la cola, el coste recae sobre todos los demás, y los artículos que se retrasan son precisamente los que habrían pasado rápido.

Por qué un límite de frecuencia, y por qué es tosco

Un tope estricto es un instrumento burdo. Dos artículos al mes es generoso para la mayoría de los investigadores y restrictivo para unos pocos, y no sirve para distinguir a un autor genuinamente prolífico de alguien que inunda el sistema. arXiv es consciente de ello y enmarca el límite como una solución provisional que gana tiempo para mejorar sus herramientas y procesos de revisión. Anteriormente, la plataforma dejaba que los moderadores restringieran a los remitentes de alta frecuencia caso por caso; a partir del 1 de octubre, esa discrecionalidad se estandariza en una regla.

La señal más clara de todo el episodio es lo que arXiv no hizo. No exigió detección de IA, no cambió sus requisitos de divulgación y no restringió la categoría cs.AI. Fue tras el volumen, porque el volumen es la parte fácil de medir y difícil de discutir. Si eso resuelve el problema de fondo es una cuestión aparte. Un actor malintencionado decidido aún puede enviar dos artículos de baja calidad al mes, y el verdadero control de calidad sigue siendo el moderador humano que los lee.

Lo que un límite de frecuencia puede y no puede hacer

Vale la pena ser precisos sobre qué problema aborda el tope. Ralentiza la tasa de envíos para todos. No eleva la calidad de lo que se envía y no mejora la capacidad de arXiv para distinguir el trabajo bueno del relleno generado por máquina. Un tope es un control de volumen, y la cuestión de la calidad permanece exactamente donde estaba.

Eso deja dos posibilidades. O la avalancha se debía sobre todo a la oportunidad, en cuyo caso un límite de ritmo desalienta la actividad ocasional y la cola se recupera, o la avalancha refleja un cambio duradero en cuánta producción investigadora se está generando, en cuyo caso el tope simplemente reparte el mismo volumen a lo largo de más meses. El propio planteamiento de arXiv, al calificar el límite de transitorio, sugiere que espera lo primero. La respuesta honesta es que nadie lo sabe aún, y los próximos meses de datos de envíos serán la primera evidencia en uno u otro sentido.

Hay un efecto más sutil que puede importar más que el directo. Un límite de frecuencia cambia el incentivo para el remitente marginal. Si puedes publicar dos artículos al mes, tienes una razón para combinar las rebanadas de salami en un solo artículo, que es lo que los revisores querían desde el principio. Un instrumento burdo puede aun así orientar el comportamiento en una dirección útil, incluso cuando no resuelve el problema de capacidad de fondo.

El patrón más amplio

arXiv es la instancia más visible de un problema que se extiende por la web abierta y los sistemas que dependen de ella. Las canalizaciones de filtrado ahora lo miden directamente: en los datos de junio a agosto detrás de un importante corpus de texto web, la proporción de tokens generados por IA subió del 27 al 31 por ciento tras el filtrado. Ahora se estima que aproximadamente un tercio del texto limpio de la web abierta es generado por máquina, y esa proporción va en aumento.

La consecuencia es una lenta erosión de las señales que la gente usa para juzgar la calidad. Un recuento de citas significa menos cuando producir artículos es barato. Un resultado de búsqueda significa menos cuando un tercio del corpus es generado. Una cola de revisión significa menos cuando el volumen de envíos supera al de los revisores. Todo sistema construido sobre el supuesto de que producir texto es caro tiene que reconstruirse para un mundo en el que es casi gratis.

Aquí hay una objeción justa, y merece ser expuesta. La escritura asistida por IA no es automáticamente mala escritura. Muchos investigadores usan estas herramientas para pulir la prosa, traducir u organizar una revisión de la literatura, y el resultado es un artículo más claro. La propia política de arXiv lo acepta. El problema no es la herramienta, es el volumen, y las herramientas hacen que el volumen sea fácil.

Lo que señala el límite

Leído a nivel de política, el tope de arXiv es un reconocimiento silencioso de que la plataforma no puede escalar su revisión humana tan rápido como la IA generativa puede escalar los envíos. Es un desajuste estructural, y ningún límite de frecuencia lo resuelve. Lo máximo que puede hacer es frenar la avalancha lo suficiente para que los voluntarios puedan seguir el ritmo.

Dos cosas definirán lo que ocurra a continuación. Una es si otros servidores de preprints y revistas adoptan sus propios límites, lo que fragmentaría la forma en que se comparte la investigación. La otra es si las herramientas de revisión se ponen al día, porque un tope de frecuencia es una forma de ganar tiempo precisamente para eso. Si las herramientas llegan, el tope es temporal, como dice arXiv. Si no llegan, el límite se vuelve permanente, y el modelo de acceso abierto absorbe una restricción que nunca había tenido. En cualquier caso, la era de barra libre en los envíos de preprints terminó el 1 de octubre, y terminó porque hacer un artículo se volvió demasiado fácil para servir de filtro.

Artículos relacionados