Academic Jobs - Home of Higher Ed Logo

La formación de IA de los editores sobre contenido académico enfrenta escrutinio y posible litigio

Publicar una historia
36Opinión
Native advertising — guest articles from $400See packages
a poster on a wall
Photo by Dedale on Unsplash

El momento suele llegar como un correo electrónico.Un investigador recibe una nota de formulario de un editor de revista: el acuerdo del autor ahora cubre el aprendizaje automático, la minería de datos y el entrenamiento de modelos de idioma de gran tamaño.La palabra 'incluyendo' aparece antes de una lista de usos que no existían cuando la revista publicó el trabajo por primera vez.El autor tiene una pregunta: ¿acabo de licenciar mi beca para entrenar a un AI, y por qué nadie preguntó primero?

Los editores académicos, que se enfrentan al crecimiento de la suscripción plana y al alto costo de mantener plataformas de revistas, han comenzado a vender el acceso a contenidos académicos para la formación de IA. Las compañías del otro lado de esos acuerdos incluyen a Microsoft y otros desarrolladores construyendo modelos de idiomas grandes, que necesitan una enorme corpora de texto confiable para mejorar su producción.

Los autores y las sociedades académicas describen algo más cercano a una sorpresa: el contenido cargado a los sistemas editoriales hace años ahora está siendo empacado como datos de formación, a menudo bajo contratos que los autores nunca vieron, con términos de licencia que permanecen inciertos y plazos de exclusión enterrados en las configuraciones del portal.

Cómo funcionan los acuerdos

Taylor & Francis, propiedad de Informa, se convirtió en el ejemplo más visible en 2024 cuando The Bookseller informó que la compañía había firmado un acuerdo de datos de IA con Microsoft. El editor más tarde dijo que los autores podrían optar por no utilizar su trabajo, pero muchos investigadores aprendieron del arreglo a través de la prensa en lugar del editor.

Wiley ha discutido los ingresos de la licencia de IA en las comunicaciones de los inversores públicos, y Cambridge University Press & Evaluation ha publicado principios que dicen que puede licenciar ciertas obras académicas para la formación de IA a menos que los autores opten por salir.

Algunos editores han dicho que los autores recibirán una parte de los ingresos de licencia. Otros han tratado los arreglos como parte de las operaciones generales sin especificar la compensación del autor. Debido a que el dinero es agregado y los acuerdos son confidenciales, los autores no tienen una manera fácil de saber si su artículo particular fue incluido, qué modelo lo usó, o cuánto contribuyó un solo papel.

a stack of books sitting on top of a wooden table

Photo by Jotform on Unsplash

Por qué los investigadores están empujando hacia atrás

ElAutores de Guildha advertido a los editores contra tratar las cláusulas de IA como una boilerplate de rutina.Sociedad de AutoresHa pedido a los autores que se les pida el consentimiento explícito antes de que su trabajo entre en un corpus de capacitación, y una encuesta de la Sociedad de Licenciamiento y Colección de Autores encontró que la mayoría de los escritores creen que deben ser preguntados y pagados cuando su trabajo se utiliza para entrenar sistemas de IA.

Esta reacción ha ido mucho más allá de las quejas individuales.Como informó AcademicJobs en su cobertura deAutor backlash en licencias de AI, varias revistas de la sociedad descubrieron que sus editores no habían consultado los consejos de redacción o habían enmarcado el acuerdo como un asunto operativo fuera de la gobernanza académica.

Los estudiosos de humanidades se preocupan de que una amplia licencia pudiera permitir a un modelo parafrasear o reproducir un argumento sin atribuir. investigadores biomédicos se preocupan de cómo la corporación de capacitación maneja tablas, informes de ensayos clínicos y archivos de datos complementarios anotados. defensores del acceso abierto señalan que muchas políticas de financiamiento requieren que las obras sean reutilizables bajo licencias Creative Commons, y un acuerdo de capacitación comercial separado puede estar incómodo con esas promesas para los lectores y los contribuyentes.

Muchas sociedades aprendidas tienen su propia participación. muchas revistas propias, pero licencian las operaciones de publicación a las grandes casas; ahora se preguntan si esas casas pueden atacar los acuerdos de IA unilateralmente, y si los miembros de la sociedad deben tener una palabra antes de que el archivo que construyeron se convierta en un activo de formación.

Lo que dice la ley y lo que no

En los Estados Unidos y el Reino Unido, el copyright protege la expresión específica en un artículo o libro, no los hechos o ideas subyacentes. Un editor que posee o controla el copyright en una obra puede generalmente licenciar que trabaje para un nuevo uso, siempre que el contrato lo apoye. Pero muchos acuerdos de publicación anteriores no mencionan grandes modelos de idiomas, aprendizaje automático o extracción de texto y datos. Los tribunales aún no han decidido si una concesión estándar de "todos los derechos electrónicos" alcanza la capacitación de IA, y los académicos del derecho difieren en si la capacitación es una reproducción, una transformación o una actividad fuera del conjunto de derechos exclusivos por completo.

La Unión Europea tiene un escudo de armas más estrecho.Artículo 4Directiva Europea de Derechos de Autorpermite la extracción de texto y datos con fines comerciales, a menos que los titulares de derechos hayan reservado expresamente el derecho de una manera legible por máquina.Un editor o autor que reserva los derechos puede, por lo tanto, optar por no participar en el nivel del material mismo, pero el efecto práctico depende de si la reserva es honrada a continuación por los intermediarios de datos y los desarrolladores de modelos.

El litigio estadounidense ha dirigido hasta ahora a empresas de tecnología en lugar de a editores. La Guardia de Autores y escritores individuales han demandado a OpenAI y a otros, argumentando que el uso de colecciones y libros no autorizados equivale a la violación de derechos de autor. Estos casos no resuelven directamente la cuestión de la licencia de editores, pero su resultado dará forma a lo que vale una licencia de formación. Si los tribunales sostienen que la formación en obras protegidas por derechos de autor sin una licencia es un uso justo, el valor de estos acuerdos de editores podría debilitarse.

Los autores que creen que un editor ha sobrepasado los derechos otorgados en un acuerdo de publicación pueden demandar por violación de contrato, buscar decisiones declarativas, o emitir cartas pre-acción que exijan contabilizar los ingresos de la licencia. Debido a que muchos acuerdos se rigen por leyes nacionales diferentes y contienen cláusulas de arbitraje, cualquier disputa es más probable que se resuelva como una serie de reclamaciones privadas que como una acción de clase limpia.

text

Photo by Brett Jordan on Unsplash

El problema del contrato oculto a la vista

Vea un acuerdo de autor típico de 2012. Se otorga al editor el derecho de reproducir, distribuir y sublicenciar la contribución en todas las formas y medios ahora conocidos o posteriormente desarrollados. El abogado de un editor leerá esa cláusula como cubriendo la formación de IA. Un autor la leerá como cubriendo libros electrónicos y bases de datos. Ni siquiera puede estar seguro, porque ningún tribunal ha interpretado la cláusula en este entorno, y los contratos generalmente no dicen nada sobre datos de formación, atribución o revocación del autor.

Algunos contratos más recientes intentan eliminar la ambigüedad. Taylor & Francis y Cambridge University Press han introducido cláusulas que se refieren directamente a la formación de IA y establecen opciones de opt-out. Pero el framing importa. Un sistema de opt-out coloca la carga en el autor para monitorear los anuncios de los editores y responder por un plazo. Esto es un patrón familiar de los acuerdos de transición de acceso abierto, y tiende a amplificar las voces que ya entienden la licencia mientras que los grupos más silenciosos se inscriben por defecto.

Investigadores de instituciones con fuertes oficinas de derechos de autor han comenzado a pedir acuerdos de publicación de maestría que reserven los derechos de IA al autor a menos que se negocien por separado.Algunas universidades europeas ahora aconsejan a la facultad que añada un piloto a los contratos de revistas: el trabajo puede ser publicado en la revista, pero el autor mantiene el derecho de controlar los usos comerciales del aprendizaje automático.

Qué buscar en un acuerdo:

  • ¿El contrato menciona modelos de idiomas grandes, aprendizaje automático o extracción de texto y datos?
  • ¿Es el uso de la IA tratado como un derecho separado que requiere un pago separado, o plegado en un lenguaje de sublicencia existente?
  • ¿Se aplica la exclusión sólo a obras futuras, o a archivos ya existentes en el sistema del editor?
  • ¿Qué ocurre con la cláusula si usted rechaza, y cuánto tiempo tiene que responder?

Qué puede hacer una universidad de investigación ahora

Las oficinas de investigación universitarias pueden dar un paso concreto este mes. Agregue una sola pregunta a su lista de verificación de pre-publicación: ¿este acuerdo menciona la formación de IA o el aprendizaje automático, y qué sucede si usted rechaza? Para muchos autores la respuesta será que el editor nunca ha planteado el problema. Para algunos será una caja de verificación que han perdido. Hazlo visible antes de que el contrato sea firmado, no después de que se haya construido el corpus de formación.

La controversia es solo en parte sobre los derechos de autor. También se trata de si los estudiosos saben, y tienen una palabra en, lo que sucede con el registro que pasaron años construyendo.Los editores que hacen el arreglo legible en lenguaje simple, con opciones reales y una parte justa de los ingresos, se enfrentarán a mucho menos de la inspección que ahora se dirige a su camino.

Retrato de Prof. Sophie Martinez
Sobre el autor

Prof. Sophie MartinezVer autor

Academic Jobs In House Author

Los reconocimientos:

Discusión

por lo menos:

Sé el primero en comentar este artículo!

tú

Se le pedirá que se conecte antes de publicar su comentario.

Nuevo0 comments

¡Únete a la conversación!

¡Añade sus comentarios ahora!

Tenga su palabra

Nivel de compromiso

Browse por Facultad

Browse por tema

Frequently Asked Questions

❓¿Qué significa la formación de IA de los editores sobre contenido académico?

Significa que un editor otorga licencia a un proveedor de tecnología para utilizar artículos de revistas, libros u otras obras académicas para entrenar modelos de lenguaje grandes como los modelos GPT de OpenAI. El editor puede vender o ofrecer acceso al texto y el modelo aprende patrones de la escritura antes de producir nuevo texto.

📚¿Qué editores académicos han firmado acuerdos de formación de IA?

Taylor & Francis, parte de Informa, firmó un acuerdo de datos de IA con Microsoft en 2024. Wiley ha hablado con inversores sobre ingresos por licencias de IA y Cambridge University Press & Assessment ha publicado principios que permiten que algunas obras académicas sean licenciadas para la formación de IA a menos que los autores opten por no participar.

💰¿Los autores académicos reciben pago cuando se utiliza su trabajo para entrenamiento de IA?

El pago varía y a menudo no se detalla. Algunos editores han dicho que los autores recibirán una parte de los ingresos por licencia, mientras que otros no han especificado la compensación para los autores. Debido a que los acuerdos son confidenciales, un autor suele no poder saber si un artículo en particular se utilizó o qué valor aportó un solo artículo.

🚪¿Pueden los autores optar por no participar en la formación de IA en acuerdos con editores?

Algunos editores ofrecen la posibilidad de optar por no participar, generalmente a través de un portal de autores o sistema de envío. La exclusión puede aplicarse solo a trabajos enviados recientemente, puede requerir acción antes de una fecha límite y puede no cubrir contenido anterior ya en el archivo del editor.

⚖️¿Es legal que los editores licencien contenido académico para la formación de IA?

La respuesta depende del contrato y del país. En Estados Unidos y Reino Unido, un editor puede licenciar generalmente obras que posee o controla, pero los contratos más antiguos pueden no abordar claramente la formación de inteligencia artificial. En la Unión Europea, el artículo 4 de la Directiva de Derechos de Autor permite la minería de texto y datos comerciales a menos que los derechos estén expresamente reservados.

🗣️¿Qué están diciendo los autores y las sociedades académicas sobre los acuerdos de formación de inteligencia artificial?

El Authors Guild ha advertido a los editores que no traten la licencia de IA como un cláusula estándar, y la Sociedad de Autores del Reino Unido ha pedido el consentimiento explícito de los autores. Muchas sociedades científicas quieren tener voz antes de que las revistas que poseen sean licenciadas a empresas tecnológicas por sus socios editoriales.

🔓¿Los acuerdos de formación de IA entran en conflicto con el acceso abierto o las directrices de los financiadores?

Pueden sentarse incómodamente juntos. Algunos financiadores requieren que las obras se distribuyan bajo licencias Creative Commons que permitan el reuso, mientras que un acuerdo comercial de formación separado puede imponer restricciones adicionales. Los autores deben comprobar si los términos de IA de un editor entran en conflicto con los términos adjuntos a la versión de registro o al manuscrito aceptado.

🏛️¿Han sido demandadas las editoriales académicas por contenido de formación de inteligencia artificial?

Los litigios más destacados han apuntado a empresas tecnológicas como OpenAI, no a editoriales académicas. Es más probable que los conflictos que enfrentan las editoriales prosigan como demandas por incumplimiento de contrato o contabilizaciones previas a la acción, porque la cuestión central es si el acuerdo de autor existente de la editorial cubría el aprendizaje automático.

🔍¿Qué deben buscar los investigadores en un contrato de publicación antes de firmar?

Busque una mención explícita del entrenamiento de IA, aprendizaje automático, minería de texto y datos, o grandes modelos de lenguaje. Verifique si el uso de IA está incluido en el lenguaje de sublicencia existente, si el pago es separado, si la exclusión cubre trabajos anteriores y qué sucede si lo rechaza. Agregue un anexo si su institución requiere su consentimiento para el aprendizaje automático comercial.

🏫¿Cómo pueden ayudar las oficinas de investigación universitarias a los profesores con la licencia de IA de los editores?

Las oficinas de investigación pueden agregar una sola pregunta a las listas de comprobación previa a la publicación: ¿este acuerdo menciona la formación de inteligencia artificial o el aprendizaje automático, y qué sucede si se declina? También pueden mantener una guía breve sobre las cláusulas de inteligencia artificial de los editores y aconsejar a los autores que resuelvan el problema antes de que el trabajo sea aceptado, no después.