Le chiffre le plus conséquent dans la publication académique actuellement n'est pas un facteur d'impact.Il s'agit d'une queue de retrait qu'un éditeur ne peut toujours pas fermer.Wiley a acquis l'éditeur d'accès ouvert Hindawi pour 298 millions de dollars en 2021.Au moment où Wiley a retiré le nom Hindawi et a déclaré qu'il fermerait 19 revues Hindawi en 2024, des milliers de journaux avaient été retirés après que des enquêtes aient révélé l'activité du moulin à papier, les fausses bagues d'évaluation par les pairs, les données fabriquées et les images manipulées.
Ce nombre ne s'est pas produit parce que les chercheurs ont soudainement perdu leur éthique. Il s'est passé parce que la production industrielle de la science fausse est devenue moins chère et plus rapide. L'IA générative a produit des abstracts et des introductions passables à l'échelle. Les usines de papier ont emballé ces mots avec des données fabriquées et vendus des slots d'auteur. Les journaux qui facturent des frais de traitement d'article (APC) sur l'acceptation ont rendu le volume rentable. examen des pairs, le filtre destiné à attraper la fraude, dépend toujours du travail académique non payé et de l'hypothèse qu'une soumission est authentique jusqu'à ce que quelqu'un prouve le contraire.
L'échelle compte parce que l'examen par les pairs n'a jamais été conçu pour authentifier l'auteur. Il a été conçu pour juger les méthodes et les arguments. Un manuscrit fabriqué écrit par une équipe coordonnée peut paraître plus propre qu'un papier authentique par un postdoc fatigué.
Les moulins à papier ont fonctionné de la même manière depuis des décennies. Un courtier recrute un chercheur qui a besoin de publications pour la promotion ou l'avancement professionnel. Dans une opération typique, le courtier organise un manuscrit écrit par fantôme, fournit ou fabrique un ensemble de données, soumet le papier et suggère parfois aux critiques dont les adresses de courrier électronique parcourent le moulin. Les critiques reviennent favorables.
L'IA générative n'a pas inventé cette entreprise, mais elle a supprimé ses coûts de production les plus importants. La génération de langues bon marché signifie que les usines peuvent inonder des journaux avec du texte qui ne traverse plus les vérifications de grammaire ou de plagiat. Le volume de soumission augmente. Les éditeurs et les critiques, généralement les membres du corps professoral travaillant sans rémunération, voient plus de manuscrits qui semblent plausibles mais sont vides.
Les problèmes spéciaux édités par les invités sont un point d'entrée commun. Un moulin peut recruter ou faire semblant d'éditeur invité, remplir un problème avec des soumissions coordonnées, exploiter la nécessité d'un journal de publier à l'heure, et se cacher derrière de faux identifiants.
Voici le catch
Le problème n'est pas que le logiciel de détection n'existe pas. Le problème est que chaque outil de détection crée un nouveau coût, et personne n'a convenu de qui le porte.Hub d’intégrité STM, géré par l'Association internationale des éditeurs scientifiques, techniques et médicaux, qui signale les soumissions dupliquées et les marqueurs de moulin à papier sur les revues participantes. Springer Nature exécute son propre logiciel, Geppetto, pour repérer la manipulation du texte et de l'image générés par l'IA.
Ces outils sont triage, pas de preuve. Un drapeau a encore besoin d'une enquête humaine, et les enquêteurs humains sont exactement la ressource en manque d'approvisionnement. Les faux positifs s'accumulent aussi. La prose académique formelle écrite par un non-natif anglais peut être flagellée comme générée par machine. Chaque faux drapeau consomme du temps de l'éditeur et risque d'aliéner un véritable auteur. Un moulin à papier, entre-temps, peut router son texte à travers un paraphraser et essayer à nouveau. Les machines s'améliorent, mais les moulins s'améliorent en réponse.
Photo by Brett Jordan on Unsplash
La course aux armes de détection, classée
Hype: les détecteurs d'IA et les logiciels d'intégrité peuvent nettoyer les évaluations par les pairs. réalité: ils peuvent identifier les schémas, mais pas l'intention.COPE, Comité sur l’éthique des publications, il a été clair que les signaux logiciels seuls ne sont pas la preuve de l'implication de la machine à papier; les éditeurs doivent enquêter avant d'agir.
- Dupliquer des images sur des documents supposément non liés
- Réseaux d’auteurs qui se répètent dans différentes revues sans collaboration plausible
- Ensembles de données qui ne correspondent pas aux expériences décrites dans le manuscrit
- Les adresses e-mail de Reviewer qui remontent aux mêmes fournisseurs gratuits ou adresses IP que les auteurs
Chacun de ces signaux peut apparaître dans un travail légitime. Un véritable auteur peut réutiliser une figure par erreur, partager un réseau avec un co-auteur, choisir une adresse e-mail générique, ou soumettre à partir du même réseau du campus qu'un collègue. La valeur du logiciel provient de la rapidité avec laquelle il réduit le pool pour les éditeurs. Il ne remplace pas le jugement éditorial, et il ne peut pas arrêter un moulin déterminé qui varie ses modèles de soumission.
Qui paie pour le nettoyage
L'argent est la partie de l'avis des universités. Une soumission de moulin à papier ne gaspille pas seulement le temps de l'examinateur; il peut finir dans le dossier de mandat d'un chercheur, un rapport de subvention, ou une évaluation de la recherche nationale. Les retraits arrivent souvent des années plus tard, après la promotion est approuvée et l'institution a déjà annoncé la sortie de l'auteur. Les bureaux d'intégrité de la recherche passent ensuite des mois à reconstruire ce qui s'est passé. L'auteur peut revendiquer l'ignorance, l'intermédiaire a disparu, la revue a continué, et l'institution est laissée tenir le dossier.
À travers les campus, la réponse à la politique a été fragmentée.Certaines universités affichent désormais des listes de publication lors de l'embauche de professeurs; d'autres comptent sur des comités de recherche sans formation dans les vérifications de publication judiciaire.Les règles d’intégrité académiqueSans un standard partagé, le même document problématique peut noyer un candidat et glisser devant un autre comité.
Le problème de l'éditeur personne ne veut nommer
Les éditeurs ont un incitatif gênant. Les journaux qui facturent des APC pour l'acceptation gagnent de l'argent lorsque les articles passent l'examen. Les journaux qui exécutent des sujets spéciaux, en particulier des collections éditées par des invités, ont été touchés par les usines parce que les éditeurs invités peuvent être recrutés ou déguisés. La pression pour remplir des pages collide avec le devoir de rejeter. Certains éditeurs ont fermé des programmes d'émission spéciale ou suspendu des journaux après la fraude. D'autres n'ont pas.
Le suivi de l’échelle n’est pas difficile.Retraction Watch maintient une base de données publiqueLa base de données est devenue un outil de travail pour les journalistes, les responsables de l'intégrité de la recherche, les comités d'embauche et les panneaux d'examen de mandat. Le fait qu'une telle base de données soit nécessaire vous dit à quel point le fossé de vérification a augmenté.
Photo by Brett Jordan on Unsplash
Le problème du personnel derrière la correction du logiciel
La correction n'est pas un détecteur plus intelligent. Il s'agit d'un changement dans qui vérifie, et quand. Si les listes de publication ont été vérifiées au moment de l'embauche, de la promotion, de la demande de subvention et du temps d'examen annuel, le marché des papiers fabriqués se rétrécirait parce que l'attestation perdrait de la valeur. Les données et le code pourraient être nécessaires avant l'examen, pas après. Les éditeurs pourraient recevoir le temps, l'état, le budget et la formation pour enquêter sur les soumissions suspectes au lieu d'espérer des avis d'un réviseur volontaire. Rien de cela ne nécessite une percée dans l'IA. Il faut que les universités et les
Anna Abalkina, sociologue à l’Université Libre de Berlin qui a documenté les réseaux de moulins à papier dans plusieurs pays, a montré à plusieurs reprises que ces réseaux répondent à la pression de la publication, pas au logiciel.
