En juin 2023, Nature a dit aux auteurs quelque chose qui aurait semblé étrange cinq ans plus tôt: les images et les vidéos produites avec l'IA générative n'étaient plus acceptables dans ses revues. L'annonce a tiré une ligne qui avait disparu. Le texte produit par un grand modèle de langue pourrait parfois être autorisé avec une divulgation minutieuse, mais les pixels produits par un modèle de diffusion ont été traités comme un risque différent. Depuis lors, la famille des revues Science, le réseau JAMA et le portefeuille plus large de Springer Nature se sont déplacés dans la même direction, bien que les détails varient suffisamment pour attraper les auteurs.
Ce qui était autrefois une question de métadonnées – qui a fait cette figure, et avec quel outil – est devenu une question de conformité éditoriale. Les journaux ne rejettent pas l’IA parce que les outils sont nouveaux. Ils rejettent les images parce que les images ne laissent pas une trace d’audit fiable. Un passage de texte peut être vérifié contre les prompts, les dessins et les journaux de modèle. Un blot western synthétique, un panneau de microscopie généré ou un graphique modifié par l’IA où les barres d’erreur ont été inventées plutôt que mesurées ne peut pas être vérifié de la même manière.
La séparation entre le texte et les pixels
La politique de Nature 2023 a fait quelque chose d'une utilité inhabituelle: elle a forcé les auteurs à séparer les règles pour le texte, le code, les données brutes et les images au lieu de les traiter comme un seul problème.Le résultat est une division qui apparaît maintenant dans les listes de vérification des soumissions.Un auteur qui utilise un modèle de langue pour polir la prose peut passer avec une déclaration.Le même auteur avec un schéma généré par l'IA entre dans une interdiction absolue.
Les revues scientifiques prennent une ligne similaire, réservant les chiffres générés par l'IA pour les cas qui reçoivent l'approbation éditoriale explicite et exigeant que les auteurs divulguent toute utilisation de l'IA générative n'importe où dans le travail. JAMA Network a pris une position similaire: les images générées par l'IA ne sont considérées que lorsqu'elles font partie de la recherche elle-même.
Pourquoi les images ont été singulées
La manipulation de l'image n'est pas un problème d'IA générateur. Il s'agit d'un problème de biologie numérique qui précède les modèles de diffusion d'une décennie. Les journaux ont commencé à déployer le dépistage médical après que les bandes dupliquées et les champs de microscopie clonés aient été la raison la plus courante des retractions au niveau de l'image. L'arrivée des générateurs d'image d'IA a comprimé la chronologie: un auteur sans fond de banc pouvait produire une image cellulaire plausible en quelques minutes, et les vérifications traditionnelles de fichiers source ont cessé de fonctionner.Les outils de détection de manipulation d'image sont maintenant intégrés plus tôt dans le processus de révisionLe .
L'éditorial de Nature de juin 2023 a souligné le problème central en termes simples. les images d'IA génératives ne peuvent pas être tracées à des données, des méthodes ou des fichiers source.L’éditeurIl a également noté des exceptions à la recherche sur les systèmes d'IA, une sculpture qui empêche la politique de bloquer le travail légitime dans l'apprentissage automatique et la vision informatique.
Le taux de base et l’exception
Avant l'IA générative, le taux de base pour les images problématiques était déjà mesurable. Dans un écran de 20 621 articles répartis dans 40 revues,Elisabeth Bik et ses collègues ont trouvé une duplication d'image inappropriée chez 3,8 pour centC'est environ un papier sur 26, et c'est le sol, pas le plafond, parce que l'étude s'est appuyée sur l'inspection visuelle plutôt que la détection automatisée à travers chaque chiffre.
L'exception aux nouvelles interdictions est plus étroite que ce que beaucoup d'auteurs s'attendent. Les journaux qui interdisent les images d'IA permettent toujours le traitement assisté par l'IA tels que le dénoisement ou la déconvolution et l'ajustement de contraste simple qui laisse les valeurs de pixels intactes, lorsqu'elles sont divulguées et ne fabriquent pas de détails. Le test est généralement une question: l'outil a-t-il inventé quelque chose qui n'était pas dans les données sous-jacentes? Si oui, il appartient à la catégorie interdite.
Une collaboratrice — appelle-la Dr. O — a utilisé un modèle texte-image pour faire un schéma d'un flux de travail expérimental pour une revue. Il a l'air propre, elle l'a soumis. Le journal a demandé des fichiers source; il n'y en avait pas. Aucune couche, aucun chemin vectoriel, aucun script, juste un PNG. La figure a été rejetée sur la documentation, pas sur le contenu. Elle l'a redécrit dans BioRender le même après-midi et le fichier révisé a été adopté. La politique n'a pas rejeté son honnêteté; elle a rejeté des preuves qui ne pouvaient pas être auditées.
Ce que les auteurs ont à dire aux journaux
Les exigences en matière de divulgation se sont déplacées des approbations générales aux déclarations de lignes-éléments.Mise à jour ICMJE sur l'auteur et la divulgation de l'IAL’IA ne peut pas être un auteur et son utilisation dans n’importe quelle partie de l’œuvre, y compris la création de figure, doit être signalée.
Les journaux scientifiques demandent aux auteurs de spécifier quel outil a été utilisé et comment, et les éditeurs peuvent demander les données non traitées originales derrière n'importe quelle figure.Les directives plus larges de Springer Nature établissent des déclarations distinctes pour l'édition de langue, le traitement d'image et la génération de code.Un manuscrit qui utilise un contrôleur de grammaire pour le texte se trouve dans une catégorie différente de celle qui utilise un modèle de diffusion pour une figure, et le formulaire de soumission demande maintenant lequel l'auteur a fait.La politique de Springer Natureest une feuille de crib utile lorsque la forme spécifique au journal est vague.
Ce que cela signifie pour votre laboratoire
La charge pratique revient sur les laboratoires qui produisent des chiffres, pas sur les éditeurs. Cette charge est petite si elle est intégrée dans le pipeline des chiffres et grande si elle est découverte lors de la révision.
- Conservez le fichier image brut, le fichier traité et le script ou les paramètres qui les relient. Un PNG seul n'est plus un fichier source.
- Si vous utilisez un traitement assisté par l’IA, enregistrez l’outil, la version, le prompt ou les paramètres et les panneaux spécifiques auxquels il a touché.
- Vérifiez la politique de figure du journal cible avant de commencer à dessiner, pas lorsque vous téléchargez.Un chiffre interdit découvert lors de la révision coûte plus que le temps nécessaire pour le redessiner.
- Assignez une personne dans le laboratoire pour posséder le dossier de documentation d'image. Cette habitude convertit une demande de conformité d'un scramble en un courrier électronique de cinq minutes.
Rien de cela ne rend les chiffres plus scientifiques.Il les rend plus vérifiables, ce que les éditeurs de propriétés disent qu'ils peuvent appliquer à l'échelle.
Où les règles peuvent être brisées
Ces politiques sont plus propres sur le papier que dans la pratique. La divulgation dépend de la mémoire de l'auteur, et les outils de détection ne marquent pas fiablement un pixel comme synthétique. Ils trouvent la duplication, le clonage, les filtres insérés et les artefacts de compression, puis les éditeurs utilisent ces résultats pour demander des fichiers bruts.
Les données de formation pour les modèles texte-image comprennent des chiffres tirés de revues et de serveurs de préimpression, et certains éditeurs ont signé des accords pour concéder des licences à leurs archives.Combats juridiques sur la formation des éditeurs AICela va façonner ce que les auteurs peuvent soumettre avec confiance des années avant que les outils de détection n’arrivent.
Avant de soumettre
Ouvrez la politique éditoriale du journal et recherchez le mot "image".Si la politique interdit les chiffres générés par l'IA, prévoyez de fournir des fichiers source pour chaque panneau.Si cela les permet avec la divulgation, écrivez l'outil exact et la version dans la lettre de motivation et les méthodes.
Photo by Brett Jordan on Unsplash
