arXiv limita submissões a duas por mês enquanto artigos assistidos por IA chegam em massa

A partir de 1º de outubro, o arXiv limita cada submissor a dois artigos por mês calendário e três submissões ativas a qualquer momento. O limite se aplica a todas as disciplinas, não apenas à ciência da computação, e a plataforma o chama de medida transitória. É um teto de frequência no maior servidor de preprints de acesso aberto do mundo, e o motivo é um número: em setembro, o arXiv recebeu 40.363 submissões, o maior total mensal de sua história.
A tendência por trás desse número é mais acentuada do que a manchete sugere. Em setembro de 2016, o arXiv recebeu 9.869 submissões. Em setembro de 2024, eram 20.569. Dois anos depois, havia dobrado novamente, para 40.363. Os chamados de suporte endereçados à equipe do arXiv e aos moderadores voluntários subiram para quase 9.000 no mesmo período. A categoria cs.AI, sozinha, cresceu mais de seis vezes em dois anos, enquanto as outras categorias aproximadamente dobraram. A IA generativa tornou muito mais fácil escrever um artigo, estruturá-lo e produzir um grande volume de material de pesquisa aparentemente plausível, e o modelo de moderação baseado em revisão humana está sentindo o peso.
A forma do problema, não apenas o tamanho
O arXiv não proibiu a IA. Sua política permite que autores usem IA como auxílio à pesquisa, desde que o uso seja divulgado e o artigo atenda aos seus padrões de valor acadêmico, originalidade e qualidade. O que levou a plataforma a agir foi uma mudança no que está sendo submetido.
Os moderadores descrevem três padrões. Há artigos de escopo restrito com conteúdo raso. Há os artigos "salami", em que um único estudo é fatiado em várias submissões separadas. E há manuscritos com muito texto que parecem gerados por máquina. Thomas Dietterich, que preside o conselho editorial consultivo do arXiv, disse que um pequeno número de autores que submetem grandes volumes de material de baixa qualidade consome uma parcela desproporcional do tempo dos voluntários, e que o resultado são atrasos de dias a semanas para artigos que merecem revisão.
Esse último ponto é o que mais importa. Os moderadores do arXiv não são funcionários em tempo integral. São pesquisadores que revisam submissões gratuitamente. Quando uma minoria de autores que submetem em grande volume enche a fila, o custo recai sobre todos os demais, e os artigos que ficam atrasados são justamente os que teriam passado rapidamente.
Por que um limite de frequência, e por que ele é uma medida grosseira
Um teto rígido é um instrumento grosseiro. Dois artigos por mês é generoso para a maioria dos pesquisadores e restritivo para alguns, e não faz nada para distinguir um autor genuinamente prolífico de alguém que está inundando o sistema. O arXiv está ciente disso e apresenta o limite como uma medida paliativa que ganha tempo para melhorar suas ferramentas e processos de revisão. A plataforma já permitia que moderadores restringissem autores que submetem com alta frequência caso a caso; a partir de 1º de outubro, essa discricionariedade foi padronizada em uma regra.
O sinal mais claro de todo o episódio é o que o arXiv não fez. Não exigiu detecção de IA, não alterou seus requisitos de divulgação e não restringiu a categoria cs.AI. Ele foi atrás do volume, porque o volume é a parte fácil de medir e difícil de contestar. Se isso resolve o problema de fundo é uma questão separada. Um agente mal-intencionado e determinado ainda pode submeter dois artigos de baixa qualidade por mês, e a verdadeira verificação de qualidade continua sendo o moderador humano que os lê.
O que um limite de frequência pode e não pode fazer
Vale ser preciso sobre qual problema o teto resolve. Ele desacelera a taxa de submissão para todos. Não eleva a qualidade do que é submetido, e não melhora a capacidade do arXiv de distinguir trabalho bom de material de enchimento gerado por máquina. Um teto é um controle de volume, e a questão da qualidade permanece exatamente onde estava.
Isso deixa duas possibilidades. Ou a inundação era principalmente oportunismo, caso em que um limite de ritmo desencoraja o fluxo casual e a fila se recupera, ou a inundação reflete uma mudança duradoura no volume de produção de pesquisa, caso em que o teto apenas distribui o mesmo volume ao longo de mais meses. A própria forma como o arXiv enquadra o limite, chamando-o de transitório, sugere que ele espera o primeiro cenário. A resposta honesta é que ninguém sabe ainda, e os próximos meses de dados de submissão serão a primeira evidência em um sentido ou outro.
Há um efeito mais sutil que pode importar mais do que o efeito direto. Um limite de frequência muda o incentivo para o autor marginal. Se você pode publicar dois artigos por mês, tem motivo para combinar as fatias de salame em um único artigo, que era o que os revisores queriam desde o início. Um instrumento grosseiro ainda pode incentivar sutilmente um comportamento útil, mesmo quando não resolve o problema de capacidade subjacente.
O padrão mais amplo
O arXiv é a instância mais visível de um problema que se espalha pela web aberta e pelos sistemas que dependem dela. Os pipelines de filtragem agora o medem diretamente: nos dados de junho a agosto por trás de um importante corpus de texto da web, a parcela de tokens gerados por IA subiu de 27% para 31% após a filtragem. Estima-se agora que cerca de um terço do texto limpo da web aberta seja gerado por máquina, e essa parcela está aumentando.
A consequência é uma lenta erosão dos sinais que as pessoas usam para julgar a qualidade. Uma contagem de citações significa menos quando os artigos são baratos de produzir. Um resultado de busca significa menos quando um terço do corpus é gerado. Uma fila de revisão significa menos quando o volume de submissões supera a capacidade dos revisores. Todo sistema construído sobre a suposição de que produzir texto é caro precisa ser reconstruído para um mundo em que isso é quase gratuito.
Há uma objeção justa aqui, e ela merece ser dita. A escrita assistida por IA não é automaticamente ruim. Muitos pesquisadores usam essas ferramentas para enxugar a prosa, traduzir ou organizar uma revisão de literatura, e o resultado é um artigo mais claro. A própria política do arXiv aceita isso. O problema não é a ferramenta, é o volume, e as ferramentas tornam o volume fácil.
O que o limite sinaliza
Lido no plano da política, o teto do arXiv é um reconhecimento discreto de que a plataforma não consegue escalar sua revisão humana tão rápido quanto a IA generativa consegue escalar a submissão. Isso é um descompasso estrutural, e nenhum limite de frequência o resolve. O máximo que ele pode fazer é desacelerar a inundação o suficiente para que os voluntários consigam acompanhar.
Duas coisas definirão o que acontece a seguir. Uma é se outros servidores de preprints e periódicos seguirão com seus próprios limites, o que fragmentaria a forma como a pesquisa é compartilhada. A outra é se as ferramentas de revisão vão acompanhar, porque um teto de frequência é uma forma de ganhar tempo exatamente para isso. Se as ferramentas chegarem, o teto é temporário, como diz o arXiv. Se não chegarem, o limite se torna permanente, e o modelo de acesso aberto absorve uma restrição que nunca teve antes. De qualquer forma, a era de vale-tudo das submissões de preprints terminou em 1º de outubro, e terminou porque fazer um artigo se tornou fácil demais para servir de filtro.
Artigos relacionados
Salesforce paga US$ 2 bilhões por uma empresa que entrevista seus clientes para você
Entrevistas são evidências. Gêmeos digitais são uma previsão. A linha entre eles é o teste.
AMD compra World Labs, de Fei-Fei Li, por US$ 8,2 bilhões para dominar a IA física
A AMD está comprando um laboratório de pesquisa — e pagando por ele o preço de uma fabricante de chips.
O Google colocou uma TPU em órbita e começou a calcular o custo dos data centers espaciais
Um chip funcionando prova que a viagem é sobrevivível. Diz pouco sobre o lucro.
Alguém catalogou 13.000 maneiras de a escrita de IA se denunciar
Os sinais não desapareceram. Eles se mudaram para um lugar mais difícil de ver.