ArXiv en danger : la recherche scientifique noyée sous les articles générés par intelligence artificielle

Publié le 05 octobre 2026 à 13:25 par Christian D.

La plateforme de prépublication scientifique tire une nouvelle fois la sonnette d'alarme. Face à une marée de contenu de faible valeur, souvent généré artificiellement, ArXiv est contrainte de barricader ses portes pour ne pas sombrer.

scientifique trois bras slop illustration IA

ArXiv, la base de données de prépublication scientifique, impose une nouvelle limite stricte de deux soumissions par auteur et par mois.

Cette mesure d'urgence vise à endiguer le flux massif de documents de mauvaise qualité, largement alimenté par des outils d'IA, qui submerge ses modérateurs bénévoles et menace l'intégrité de la plateforme.

Elle croule sous un véritable déluge de publications qui a vu le nombre de soumissions mensuelles passer de moins de 10 000 il y a dix ans à plus de 40 000 en septembre 2026.

Cette inflation spectaculaire met en péril le système de validation et menace de transformer ce trésor académique en un immense dépotoir numérique.

Pourquoi arXiv est-il obligé de mettre en place un tel barrage ?

La plateforme est tout simplement noyée sous un tsunami de slop IA, des articles de recherche de faible valeur, souvent générés à la chaîne. Cette production de masse, rendue possible par les progrès de l'intelligence artificielle, engorge complètement les canaux de validation.

Le problème n'est pas tant l'outil que son usage dévoyé pour produire en quantité au détriment de la pertinence. Et les chiffres sont sans appel : les soumissions ont doublé en seulement deux ans.

workslop bureau salaries illustation ia

Kat Boboris, responsable de l'engagement communautaire chez arXiv, pointe une « augmentation des articles légers, à la portée limitée » et une pratique de « saucissonnage » où un seul travail est découpé en plusieurs petites publications.

Cette situation crée un fardeau insoutenable pour les modérateurs bénévoles, qui voient leur temps dévoré par le tri de ces contenus, retardant ainsi la publication de travaux légitimes et de grande valeur.

Quelles sont concrètement les nouvelles règles de soumission ?

Le nouveau règlement ne fait plus dans la dentelle : chaque auteur ne peut soumettre que deux articles par mois calendaire, avec une limite de trois soumissions actives (en cours d'examen) à tout moment.

Cette restriction s'applique à l'individu qui dépose le document, et ce, que le papier soit accepté ou rejeté, car chaque soumission consomme un temps précieux de modération.

intelligence artificielle.

On notera que cette limite est valable par déposant. Un article de recherche avec dix co-auteurs ne comptera que pour le quota de celui qui a cliqué sur le bouton « soumettre ».

Les grands laboratoires et les projets collaboratifs sont donc moins pénalisés que les chercheurs individuels très prolifiques. Cela force néanmoins les équipes à mieux coordonner leurs publications pour ne pas saturer le quota d'un seul de leurs membres.

Quel est l'impact réel de cette mesure sur la communauté scientifique ?

L'objectif principal est de cibler « une proportion relativement faible d'auteurs » qui, selon Thomas Dietterich, président du conseil consultatif éditorial d'arXiv, soumettent « un grand nombre d'articles de faible qualité ».

En les bridant, arXiv espère redonner de l'air aux modérateurs et garantir que la qualité des articles soumis par la majorité des chercheurs soit traitée rapidement. La mesure se veut donc protectrice pour l'écosystème entier.

scientifique intelligence artificielle illustration IA

Cependant, le risque collatéral existe. Certains chercheurs, notamment dans des domaines à évolution très rapide, pourraient se sentir freinés.

La communauté observe donc avec attention si ce garrot posé à la hâte ne va pas causer plus de tort que de bien sur le long terme, même si la situation actuelle était devenue intenable.

Cette limitation est-elle une solution permanente ?

arXiv présente cette nouvelle politique comme une mesure d'urgence temporaire. Il faut juguler l'inflation de contenus de faible qualité avant de mettre en place des solutions plus sophistiquées.

L'enjeu est de définir de nouvelles bonnes pratiques pour l'utilisation de l'IA dans la recherche et de développer des outils de modération plus efficaces.

Le phénomène n'est pas isolé. De grandes conférences en informatique comme NeurIPS ou ICLR ont déjà mis en place des limites similaires face à une explosion du nombre de soumissions.

La génération de contenu scientifique par IA est désormais inévitable et le monde académique cherche fébrilement comment gérer les conséquences du slop sans étouffer le progrès authentique.

Journaliste GNT spécialisé en mobilité / Ante-Geek des profondeurs du Web et d'ailleurs

Cette page peut contenir des liens affiliés. Si vous achetez un produit depuis ces liens, le site marchand nous reversera une commission sans que cela n'impacte en rien le montant de votre achat. En savoir plus.