Academic Jobs - Home of Higher Ed Logo

Verleger-Training für KI auf akademischen Inhalten steht unter Überprüfung und möglicher Rechtsverfolgung

Postet eine Geschichte
12Ansichten
Native advertising — guest articles from $400See packages
a poster on a wall
Photo by Dedale on Unsplash

Der Moment kommt in der Regel als eine E-Mail. Ein Forscher erhält eine Formularnote von einem Zeitschriftverlag: Die Vereinbarung des Autors deckt nun maschinelles Lernen, Datenmining und großes Sprachmodelltraining ab. Das Wort "einschließlich" erscheint vor einer Liste von Verwendungen, die nicht existierten, als das Journal das Werk zuerst veröffentlichte. Der Autor hat eine Frage: Habe ich gerade mein Stipendium lizenziert, um eine KI zu trainieren, und warum hat niemand zuerst gefragt?

Akademische Verlage, die mit einem flachen Abonnementwachstum und den hohen Kosten für die Aufrechterhaltung von Zeitschriftplattformen konfrontiert sind, haben begonnen, den Zugang zu wissenschaftlichen Inhalten für die Ausbildung von KI zu verkaufen.Die Unternehmen auf der anderen Seite dieser Vereinbarungen sind Microsoft und andere Entwickler, die große Sprachmodelle bauen, die eine massive Korporation von zuverlässigen Texten benötigen, um ihre Ausgabe zu verbessern.

Die Verleger beschreiben diese Lizenzen als einen neuen Einnahmefluss, der Zeitschriften finanziell nachhaltig hält. Autoren und wissenschaftliche Gesellschaften beschreiben etwas, das einer Überraschung näher kommt: Inhalte, die vor Jahren in redaktionelle Systeme hochgeladen wurden, werden jetzt als Schulungsdaten verpackt, oft unter Verträgen, die Autoren nie gesehen haben, mit Lizenzgebührenbedingungen, die unklar bleiben und Opt-Out-Fristen in Portaleinstellungen begraben.

Wie die Deals funktionieren

Taylor & Francis, im Besitz von Informa, wurde das sichtbarste Beispiel im Jahr 2024, als The Bookseller berichtete, dass das Unternehmen einen AI-Datenvertrag mit Microsoft unterzeichnet hatte. Der Herausgeber sagte später, Autoren könnten sich entscheiden, bevor ihre Arbeit verwendet wird, aber viele Forscher lernten von der Vereinbarung durch die Presse und nicht vom Herausgeber.

Wiley hat über die Einnahmen aus der Lizenzierung von KI in der öffentlichen Investorenkommunikation diskutiert, und Cambridge University Press & Assessment hat Grundsätze veröffentlicht, die besagen, dass es bestimmte akademische Werke für die Ausbildung von AI lizenzieren kann, es sei denn, die Autoren entscheiden sich dafür.

Zahlungsstrukturen sind selten öffentlich. Einige Verleger haben gesagt, dass Autoren einen Anteil an Lizenzierungseinnahmen erhalten werden. Andere haben die Vereinbarungen als Teil der allgemeinen Operationen behandelt, ohne die Entschädigung des Autors anzugeben. Da das Geld zusammengefasst ist und die Vereinbarungen vertraulich sind, haben Autoren keine einfache Möglichkeit zu wissen, ob ihr bestimmter Artikel enthalten war, welches Modell es benutzte oder wie viel ein einzelnes Papier beigetragen hat.

a stack of books sitting on top of a wooden table

Photo by Jotform on Unsplash

Warum Forscher zurückstoßen

DieVerfasser Guildhat Verlage vor der Behandlung von KI-Klauseln als Routine-Kesselplatte gewarnt.Gesellschaft der Autorenhat gefordert, dass Autoren um ausdrückliche Zustimmung gebeten werden, bevor ihre Arbeit in ein Trainingskorpus eintritt, und eine Umfrage der Autors' Licensing and Collecting Society fand heraus, dass die meisten Autoren glauben, dass sie gefragt und bezahlt werden sollten, wenn ihre Arbeit zur Ausbildung von KI-Systemen verwendet wird.

Diese Rückmeldung ist weit über individuelle Beschwerden hinausgegangen.Wie AcademicJobs in seiner Berichterstattung überAutor Backlash auf AI Lizenzierung Deals, mehrere gesellschaftliche Zeitschriften entdeckten, dass ihre Verleger keine Redaktionsbüros konsultiert hatten oder den Deal als eine operative Angelegenheit außerhalb der akademischen Steuerung eingeführt hatten.

Geisteswissenschaftler befürchten, dass eine breite Lizenz einem Modell erlauben könnte, ein Argument ohne Zuweisung zu paraphrasieren oder zu reproduzieren. Biomedizinische Forscher machen sich Sorgen darüber, wie Trainingskörperschaften Tabellen, klinische Prüfungsberichte und annotierte ergänzende Datendateien behandeln.

Viele haben eigene Zeitschriften, aber lizenzieren Verlagsaktivitäten an große Häuser; Sie fragen sich jetzt, ob diese Häuser KI-Deals einseitig schlagen können, und ob Gesellschaftsmitglieder ein Wort haben sollten, bevor das Archiv, das sie gebaut haben, zu einem Trainingsgegenstand wird.

Was das Gesetz sagt und was es nicht tut

In den Vereinigten Staaten und dem Vereinigten Königreich schützt das Urheberrecht den spezifischen Ausdruck in einem Artikel oder Buch, nicht die zugrunde liegenden Fakten oder Ideen. Ein Verleger, der das Urheberrecht in einem Werk besitzt oder kontrolliert, kann im Allgemeinen eine Lizenz erteilen, die für eine neue Verwendung funktioniert, sofern der Vertrag sie unterstützt. Aber viele ältere Verlagsvereinbarungen erwähnen keine großen Sprachmodelle, maschinelles Lernen oder Text- und Datenmining.

Die Europäische Union hat eine engere gesetzliche Ausgrenzung.Artikel 4EU UrheberrechtsrichtlinieText- und Datenmining für kommerzielle Zwecke erlaubt, es sei denn, Rechteinhaber haben das Recht ausdrücklich in maschinell lesbarer Weise vorbehalten.Ein Verleger oder Autor, der Rechte vorbehalten hat, kann sich daher auf der Ebene des Materials selbst abmelden, aber die praktische Wirkung hängt davon ab, ob die Vorbehaltung nachträglich von Datenmaklern und Modellentwicklern geehrt wird.

Die Authors Guild und einzelne Schriftsteller haben OpenAI und andere verklagt, indem sie argumentierten, dass die Verwendung nicht autorisierter Sammlungen und Bücher zu Urheberrechtsverletzungen führt. Diese Fälle lösen die Frage der Verlage-Lizenzierung nicht direkt, aber ihr Ergebnis wird die Ausbildungslizenz bestimmen. Wenn die Gerichte feststellen, dass die Ausbildung in urheberrechtlich geschützten Werken ohne Lizenz fair ist, könnte der Wert dieser Verlagevereinbarungen geschwächt werden.

Potenzielle Rechtsstreitigkeiten gegen Verleger liegen in einem anderen Bereich: Vertragsrecht. Autoren, die der Ansicht sind, dass ein Verleger die in einer Verlagsvereinbarung gewährten Rechte überschritten hat, können Vertragsverletzungen verklagen, erklärende Urteile anstreben oder Vorhandenseinsschreiben ausstellen, in denen Rechnungslegung der Lizenzgebühren gefordert wird.Da viele Vereinbarungen durch unterschiedliche nationale Gesetze geregelt sind und Schiedsklauseln enthalten, wird jeder Streit eher als eine Reihe privater Ansprüche als als als eine Reinklasse-Aktion gelöst.

text

Photo by Brett Jordan on Unsplash

Das Vertragsproblem versteckt sich in Sicht

Sehen Sie sich eine typische Urhebervereinbarung aus dem Jahr 2012 an. Es gewährt dem Verlag das Recht, den Beitrag in allen Formaten und Medien zu reproduzieren, zu verteilen und zu sublizenzieren, die jetzt bekannt sind oder später entwickelt werden. Ein Anwalt eines Verlages wird diese Klausel als die Abdeckung von KI-Training lesen. Ein Autor wird sie als die Abdeckung von E-Books und Datenbanken lesen. Weder kann man sicher sein, weil kein Gericht die Klausel in dieser Einstellung interpretiert hat, und die Verträge sagen normalerweise nichts über Schulungsdaten, Zuweisung oder Widerruf des Autors.

Einige neuere Verträge versuchen, die Zweideutigkeit zu beseitigen. Taylor & Francis und Cambridge University Press haben Klauseln eingeführt, die sich direkt auf AI-Training beziehen und Opt-Out-Optionen festlegen. Aber das Framing ist wichtig. Ein Opt-Out-System legt den Schwerpunkt auf den Autor, Publisher-Ankündigungen zu überwachen und mit einer Frist zu reagieren. Das ist ein vertrautes Muster aus Open Access-Übergangsabkommen, und es neigt dazu, die Stimmen zu verstärken, die bereits Lizenzierung verstehen, während ruhigere Gruppen standardmäßig eingeschrieben werden.

Forscher an Institutionen mit starken Urheberbehörden haben begonnen, um Master-Veröffentlichungsvereinbarungen zu bitten, die KI-Rechte für den Autor vorbehalten, es sei denn, separat verhandelt.Einige europäische Universitäten beraten nun die Fakultät, einen Fahrer zu Zeitschriftverträgen hinzuzufügen: Die Arbeit kann in der Zeitschrift veröffentlicht werden, aber der Autor behält das Recht, die kommerzielle Verwendung von maschinellem Lernen zu kontrollieren.

Was in einer Vereinbarung zu suchen ist:

  • Erwähnt der Vertrag große Sprachmodelle, maschinelles Lernen oder Text- und Datenmining?
  • Wird die Verwendung von KI als gesondertes Recht behandelt, das eine separate Zahlung erfordert, oder in bestehende Sublicensing-Sprachen gefaltet?
  • Gilt der Opt-Out nur für zukünftige Arbeiten oder für Archive, die bereits im System des Herausgebers vorhanden sind?
  • Was passiert mit der Klausel, wenn Sie ablehnen, und wie lange müssen Sie antworten?

Was ein Forschungsbüro jetzt tun kann

Universitätsforschungsbüros können diesen Monat einen konkreten Schritt unternehmen. Fügen Sie Ihrer Vorveröffentlichungs-Checkliste eine einzige Frage hinzu: erwähnt diese Vereinbarung AI-Training oder maschinelles Lernen, und was passiert, wenn Sie ablehnen? Für viele Autoren wird die Antwort sein, dass der Herausgeber das Problem nie erhoben hat. Für einige wird es ein Checkbox sein, die sie verpasst haben. Machen Sie es sichtbar, bevor der Vertrag unterzeichnet wird, nicht nachdem das Trainingskorpus gebaut wurde.

Es geht auch darum, ob Gelehrte wissen und ein Wort darüber haben, was mit der Aufzeichnung passiert, die sie jahrelang aufgebaut haben.Verlage, die das Arrangement in einfacher Sprache lesbar machen, mit echten Opt-Outs und einem fairen Anteil an Einnahmen, werden viel weniger von der Kontrolle konfrontiert sein, die jetzt ihren Weg führt.

Porträt von Prof. Sophie Martinez
Über den Autor

Prof. Sophie MartinezAutor ansehen

Academic Jobs In House Author

Die Anerkennung :

Diskussionen

Sort von:

Seien Sie der Erste, der diesen Artikel kommentiert!

Du bist

Sie werden gebeten, sich anzumelden, bevor Ihr Kommentar veröffentlicht wird.

Neue0 comments

Treten Sie dem Gespräch bei!

Fügen Sie jetzt Ihre Kommentare hinzu!

Haben Sie Ihr Wort

Engagement Ebene

Browse nach Fakultät

Browse nach Thema

Frequently Asked Questions

❓Was bedeutet Verleger-AI-Schulung auf akademischen Inhalten?

Es bedeutet, dass ein Verlag Zeitschriftenartikel, Bücher oder andere wissenschaftliche Werke an ein Technologieunternehmen lizenziert, damit das Material verwendet werden kann, um große Sprachmodelle wie OpenAIs GPT-Modelle zu trainieren. Der Verlag kann den Zugang zum Text verkaufen oder bündeln und das Modell lernt Muster aus dem Schreiben, bevor es neuen Text produziert.

📚Welche akademischen Verlage haben AI-Trainingsvereinbarungen abgeschlossen?

Taylor & Francis, Teil von Informa, hat 2024 einen AI-Datendeal mit Microsoft abgeschlossen. Wiley hat AI-Lizenzgebühren mit Investoren diskutiert und Cambridge University Press & Assessment hat Grundsätze veröffentlicht, die es ermöglichen, einige akademische Werke für die AI-Schulung zu lizenzieren, es sei denn, die Autoren optieren aus.

💰Werden akademische Autoren bezahlt, wenn ihre Arbeit für die AI-Schulung verwendet wird?

Die Bezahlung variiert und wird oft nicht aufgeschlüsselt. Einige Verlage haben angekündigt, dass Autoren einen Anteil der Lizenzgebühren erhalten werden, während andere keine Angaben zu den Autorenvergütungen gemacht haben. Da die Vereinbarungen vertraulich sind, kann ein Autor in der Regel nicht erkennen, ob ein bestimmtes Papier verwendet wurde oder welchen Wert ein einzelner Artikel beigesteuert hat.

🚪Können Autoren sich von der AI-Schulung unter Verlagsvereinbarungen abmelden?

Einige Verlage bieten eine Abmeldung an, normalerweise über ein Autorenportal oder ein Einreichsystem. Die Abmeldung kann sich nur auf neu eingereichte Arbeiten beziehen, kann eine Maßnahme bis zu einem bestimmten Stichtag erfordern und kann ältere Inhalte, die bereits im Archiv des Verlags sind, nicht abdecken.

⚖️Ist es rechtlich zulässig, dass Verlage akademische Inhalte für die AI-Schulung lizenzieren?

Die Antwort hängt vom Vertrag und Land ab. In den Vereinigten Staaten und im Vereinigten Königreich kann ein Verleger im Allgemeinen Werke lizenzieren, die er besitzt oder kontrolliert, aber ältere Verträge können AI-Schulungen nicht klar erreichen. In der Europäischen Union erlaubt Artikel 4 der Urheberrechtsrichtlinie kommerzielles Text- und Daten-Mining, es sei denn, Rechte sind ausdrücklich vorbehalten.

🗣️Was sagen Autoren und wissenschaftliche Gesellschaften über AI-Schulungsvereinbarungen?

Der Authors Guild hat Verlage davor gewarnt, AI-Lizenzen als Routineklauseln zu behandeln, und die UK Society of Authors hat ausdrückliche Zustimmung der Autoren gefordert. Viele wissenschaftliche Gesellschaften wollen ein Mitspracherecht, bevor ihre von ihnen herausgegebenen Zeitschriften von ihren Verlagspartnern an Technologieunternehmen lizenziert werden.

🔓Stehen AI-Trainingsvereinbarungen im Widerspruch zu Open-Access- oder Förderanforderungen?

Sie können unangenehm zusammenpassen. Einige Förderer verlangen, dass Werke unter Creative-Commons-Lizenzen verbreitet werden, die die Weiterverwendung erlauben, während ein separates kommerzielles Trainingsabkommen zusätzliche Einschränkungen auferlegen kann. Autoren sollten prüfen, ob die AI-Bedingungen eines Verlegers im Konflikt mit den Bedingungen der Version of Record oder des angenommenen Manuskripts stehen.

🏛️Wurden akademische Verlage wegen des Trainingsinhalts von KI verklagt?

Die bekanntesten Klagen richteten sich gegen Technologieunternehmen wie OpenAI und nicht gegen akademische Verlage. Streitigkeiten, die sich gegen Verlage richten, werden eher als Vertragsbruch oder vorgerichtliche Abrechnungen fortgesetzt, da die zentrale Frage ist, ob die bestehende Vereinbarung des Verlags mit dem Autor den maschinellen Lernalgorithmus abdeckte.

🔍Was sollten Forscher in einem Verlagsvertrag beachten, bevor sie unterschreiben?

Suchen Sie nach expliziten Erwähnungen von KI-Training, maschinellen Lernen, Text- und Daten-Mining oder großen Sprachmodellen. Überprüfen Sie, ob die KI-Nutzung in bestehende Untervertrags-Sprache integriert ist, ob die Bezahlung separat ist, ob die Opt-out-Klausel ältere Arbeiten abdeckt und was passiert, wenn Sie ablehnen. Fügen Sie einen Zusatz an, wenn Ihre Institution Ihre Zustimmung für kommerzielles maschinelles Lernen benötigt.

🏫Wie können Universitätsforschungsbüros den Fakultätsmitgliedern bei der Lizenzierung von Verlegern helfen?

Forschungsbüros können eine einzelne Frage zu den Vorab-Prüflisten hinzufügen: Erwähnt diese Vereinbarung die AI-Schulung oder das maschinelle Lernen und was passiert, wenn Sie ablehnen? Sie können auch einen kurzen Leitfaden zu Verlags-AI-Klauseln pflegen und Autoren dazu raten, das Problem vor der Annahme der Arbeit zu lösen, nicht danach.