Academic Jobs - Home of Higher Ed Logo

Les éditeurs mettent en place de nouvelles règles pour les images générées par l'IA dans les manuscrits

Poster une histoire
12vues
Native advertising — guest articles from $400See packages
text
Photo by Brett Jordan on Unsplash

En juin 2023, Nature a dit aux auteurs quelque chose qui aurait semblé étrange cinq ans plus tôt: les images et les vidéos produites avec l'IA générative n'étaient plus acceptables dans ses revues. L'annonce a tiré une ligne qui avait disparu. Le texte produit par un grand modèle de langue pourrait parfois être autorisé avec une divulgation minutieuse, mais les pixels produits par un modèle de diffusion ont été traités comme un risque différent. Depuis lors, la famille des revues Science, le réseau JAMA et le portefeuille plus large de Springer Nature se sont déplacés dans la même direction, bien que les détails varient suffisamment pour attraper les auteurs.

Ce qui était autrefois une question de métadonnées – qui a fait cette figure, et avec quel outil – est devenu une question de conformité éditoriale. Les journaux ne rejettent pas l’IA parce que les outils sont nouveaux. Ils rejettent les images parce que les images ne laissent pas une trace d’audit fiable. Un passage de texte peut être vérifié contre les prompts, les dessins et les journaux de modèle. Un blot western synthétique, un panneau de microscopie généré ou un graphique modifié par l’IA où les barres d’erreur ont été inventées plutôt que mesurées ne peut pas être vérifié de la même manière.

La séparation entre le texte et les pixels

La politique de Nature 2023 a fait quelque chose d'une utilité inhabituelle: elle a forcé les auteurs à séparer les règles pour le texte, le code, les données brutes et les images au lieu de les traiter comme un seul problème.Le résultat est une division qui apparaît maintenant dans les listes de vérification des soumissions.Un auteur qui utilise un modèle de langue pour polir la prose peut passer avec une déclaration.Le même auteur avec un schéma généré par l'IA entre dans une interdiction absolue.

Les revues scientifiques prennent une ligne similaire, réservant les chiffres générés par l'IA pour les cas qui reçoivent l'approbation éditoriale explicite et exigeant que les auteurs divulguent toute utilisation de l'IA générative n'importe où dans le travail. JAMA Network a pris une position similaire: les images générées par l'IA ne sont considérées que lorsqu'elles font partie de la recherche elle-même.

Pourquoi les images ont été singulées

La manipulation de l'image n'est pas un problème d'IA générateur. Il s'agit d'un problème de biologie numérique qui précède les modèles de diffusion d'une décennie. Les journaux ont commencé à déployer le dépistage médical après que les bandes dupliquées et les champs de microscopie clonés aient été la raison la plus courante des retractions au niveau de l'image. L'arrivée des générateurs d'image d'IA a comprimé la chronologie: un auteur sans fond de banc pouvait produire une image cellulaire plausible en quelques minutes, et les vérifications traditionnelles de fichiers source ont cessé de fonctionner.Les outils de détection de manipulation d'image sont maintenant intégrés plus tôt dans le processus de révisionLe .

L'éditorial de Nature de juin 2023 a souligné le problème central en termes simples. les images d'IA génératives ne peuvent pas être tracées à des données, des méthodes ou des fichiers source.L’éditeurIl a également noté des exceptions à la recherche sur les systèmes d'IA, une sculpture qui empêche la politique de bloquer le travail légitime dans l'apprentissage automatique et la vision informatique.

Le taux de base et l’exception

Avant l'IA générative, le taux de base pour les images problématiques était déjà mesurable. Dans un écran de 20 621 articles répartis dans 40 revues,Elisabeth Bik et ses collègues ont trouvé une duplication d'image inappropriée chez 3,8 pour centC'est environ un papier sur 26, et c'est le sol, pas le plafond, parce que l'étude s'est appuyée sur l'inspection visuelle plutôt que la détection automatisée à travers chaque chiffre.

L'exception aux nouvelles interdictions est plus étroite que ce que beaucoup d'auteurs s'attendent. Les journaux qui interdisent les images d'IA permettent toujours le traitement assisté par l'IA tels que le dénoisement ou la déconvolution et l'ajustement de contraste simple qui laisse les valeurs de pixels intactes, lorsqu'elles sont divulguées et ne fabriquent pas de détails. Le test est généralement une question: l'outil a-t-il inventé quelque chose qui n'était pas dans les données sous-jacentes? Si oui, il appartient à la catégorie interdite.

Une collaboratrice — appelle-la Dr. O — a utilisé un modèle texte-image pour faire un schéma d'un flux de travail expérimental pour une revue. Il a l'air propre, elle l'a soumis. Le journal a demandé des fichiers source; il n'y en avait pas. Aucune couche, aucun chemin vectoriel, aucun script, juste un PNG. La figure a été rejetée sur la documentation, pas sur le contenu. Elle l'a redécrit dans BioRender le même après-midi et le fichier révisé a été adopté. La politique n'a pas rejeté son honnêteté; elle a rejeté des preuves qui ne pouvaient pas être auditées.

Ce que les auteurs ont à dire aux journaux

Les exigences en matière de divulgation se sont déplacées des approbations générales aux déclarations de lignes-éléments.Mise à jour ICMJE sur l'auteur et la divulgation de l'IAL’IA ne peut pas être un auteur et son utilisation dans n’importe quelle partie de l’œuvre, y compris la création de figure, doit être signalée.

Les journaux scientifiques demandent aux auteurs de spécifier quel outil a été utilisé et comment, et les éditeurs peuvent demander les données non traitées originales derrière n'importe quelle figure.Les directives plus larges de Springer Nature établissent des déclarations distinctes pour l'édition de langue, le traitement d'image et la génération de code.Un manuscrit qui utilise un contrôleur de grammaire pour le texte se trouve dans une catégorie différente de celle qui utilise un modèle de diffusion pour une figure, et le formulaire de soumission demande maintenant lequel l'auteur a fait.La politique de Springer Natureest une feuille de crib utile lorsque la forme spécifique au journal est vague.

Ce que cela signifie pour votre laboratoire

La charge pratique revient sur les laboratoires qui produisent des chiffres, pas sur les éditeurs. Cette charge est petite si elle est intégrée dans le pipeline des chiffres et grande si elle est découverte lors de la révision.

  • Conservez le fichier image brut, le fichier traité et le script ou les paramètres qui les relient. Un PNG seul n'est plus un fichier source.
  • Si vous utilisez un traitement assisté par l’IA, enregistrez l’outil, la version, le prompt ou les paramètres et les panneaux spécifiques auxquels il a touché.
  • Vérifiez la politique de figure du journal cible avant de commencer à dessiner, pas lorsque vous téléchargez.Un chiffre interdit découvert lors de la révision coûte plus que le temps nécessaire pour le redessiner.
  • Assignez une personne dans le laboratoire pour posséder le dossier de documentation d'image. Cette habitude convertit une demande de conformité d'un scramble en un courrier électronique de cinq minutes.

Rien de cela ne rend les chiffres plus scientifiques.Il les rend plus vérifiables, ce que les éditeurs de propriétés disent qu'ils peuvent appliquer à l'échelle.

Où les règles peuvent être brisées

Ces politiques sont plus propres sur le papier que dans la pratique. La divulgation dépend de la mémoire de l'auteur, et les outils de détection ne marquent pas fiablement un pixel comme synthétique. Ils trouvent la duplication, le clonage, les filtres insérés et les artefacts de compression, puis les éditeurs utilisent ces résultats pour demander des fichiers bruts.

Les données de formation pour les modèles texte-image comprennent des chiffres tirés de revues et de serveurs de préimpression, et certains éditeurs ont signé des accords pour concéder des licences à leurs archives.Combats juridiques sur la formation des éditeurs AICela va façonner ce que les auteurs peuvent soumettre avec confiance des années avant que les outils de détection n’arrivent.

Avant de soumettre

Ouvrez la politique éditoriale du journal et recherchez le mot "image".Si la politique interdit les chiffres générés par l'IA, prévoyez de fournir des fichiers source pour chaque panneau.Si cela les permet avec la divulgation, écrivez l'outil exact et la version dans la lettre de motivation et les méthodes.

text

Photo by Brett Jordan on Unsplash

Portrait de Dr. Nathan Harlow
A propos de l'auteur

Dr. Nathan HarlowVoir auteur

Academic Jobs In House Author

Les reconnaissances :

Discussions

Sort par :

Soyez le premier à commenter cet article !

vous

Vous serez invité à vous connecter avant de publier votre commentaire.

Nouvelle0 comments

Rejoignez la conversation !

Ajoutez vos commentaires dès maintenant !

Avoir votre mot

Niveau d’engagement

Browse par faculté

Browse par sujet

Frequently Asked Questions

📘Quels éditeurs ont interdit les images générées par l'IA ?

Nature Portfolio de Springer Nature a pris les devants en 2023 en interdisant les images et les vidéos créées ou modifiées par l'IA générative, avec de rares exceptions pour la recherche sur l'IA. La famille de revues Science et JAMA Network restreignent les figures générées par l'IA de manière similaire, tandis que de nombreuses revues Elsevier et Taylor & Francis exigent une divulgation et des fichiers sources plutôt qu'une interdiction générale. Veuillez consulter la revue ciblée.

🔬Puis-je utiliser l'IA pour ajuster le contraste ou la luminosité d'une figure ?

La plupart des politiques distinguent entre le traitement assisté par l'IA et la création générative. L'ajustement du contraste, le débruitage ou l'affinage est généralement autorisé si les données sous-jacentes sont inchangées et que le traitement est divulgué. Si un outil invente des structures, des cellules, des bandes ou des étiquettes, il entre dans un territoire interdit.

📝Dois-je déclarer l'utilisation de l'IA si je l'ai utilisée uniquement pour le texte et non pour les images ?

Oui. Les règles pour le texte et les images sont traitées séparément. De nombreux journaux autorisent l'édition de texte assistée par l'IA avec divulgation, mais interdisent ou restreignent fortement les figures générées par l'IA. Répertoriez l'outil, la version et ce qu'il a modifié dans la lettre de présentation ou les méthodes.

📂Que se passe-t-il si un éditeur soupçonne qu'une image est générée par un IA ?

Les éditeurs demanderont généralement les fichiers bruts originaux, les journaux de traitement ou les scripts logiciels. Si ces documents n'existent pas, la figure peut être rejetée même si la science est solide. L'accent est mis sur la traçabilité, et non sur la détection d'un style particulier.

📊Les graphiques générés par un IA sont-ils autorisés si les données sont réelles ?

En général, non pour la création générative. Un graphique rendu par un outil à partir de données réelles peut être acceptable, mais une figure générée par un IA qui dessine ou embellit un graphique n'est pas considérée comme une représentation fidèle des données. Utilisez plutôt une bibliothèque de tracé standard et conservez le code.

🗂️Quelle documentation devrais-je conserver pour les figures ?

Conservez les fichiers bruts, les fichiers de travail en couches, les versions de logiciels, les invites si nécessaire, ainsi qu'une courte note reliant chaque panneau à son jeu de données source. Une exportation PNG seule ne satisfait pas à une demande de fichier source.

⚙️En quoi les règles de divulgation diffèrent-elles entre le texte, le code et les images ?

Le texte et le code sont souvent autorisés avec divulgation ; les images sont plus susceptibles d'être interdites purement et simplement ou de nécessiter une approbation exceptionnelle. La raison en est la provenance. Le texte peut être vérifié par rapport aux journaux, tandis que les pixels synthétiques n'ont souvent aucune traçabilité.

✍️L'ICMJE permet-il aux IA d'être auteurs ?

Non. L'ICMJE indique qu'il est impossible de citer une IA comme auteur. Les auteurs restent responsables de tout le contenu, et l'utilisation d'une IA dans n'importe quelle partie du travail, y compris la génération d'images, doit être divulguée.

🕵️Quels outils les revues utilisent-ils pour détecter les images manipulées ou générées par l'IA ?

Les revues utilisent des outils forensiques tels que Proofig et ImageTwin, qui signalent les duplications, le clonage et les artefacts de compression plutôt que de classifier les images comme générées par l'IA. Ces outils sont les plus utiles pour exiger des fichiers sources, et non pour prouver l'origine synthétique.

🤖Y a-t-il des exceptions pour les images utilisées dans la recherche sur l'IA ?

Oui. Nature Portfolio et des politiques similaires autorisent les images générées par l'IA lorsque le système d'IA lui-même est l'objet d'étude, comme un article de vision par ordinateur démontrant les sorties du modèle. L'exception est étroite et nécessite une évaluation éditoriale explicite.

🧪Devrais-je appliquer la même politique aux préimpressions ?

Les serveurs de préimpression ont souvent des règles plus légères, mais les revues en aval appliqueront leurs propres politiques lors de la soumission. Une figure qui survit sur un serveur de préimpression peut encore nécessiter un remplacement ou des fichiers sources une fois qu'elle entre en revue par les pairs.

✅Quel est le flux de travail de figure le plus sûr pour un laboratoire nouveau à ces règles ?

Concevez des figures avec des outils standard tels qu'ImageJ, GraphPad Prism, matplotlib ou BioRender, conservez chaque fichier brut et traité, et traitez l'IA comme un aide pour la rédaction, et non pour la figure finale soumise. Vérifiez la politique de la revue avant de commencer tout travail.