Der Moment kommt in der Regel als eine E-Mail. Ein Forscher erhält eine Formularnote von einem Zeitschriftverlag: Die Vereinbarung des Autors deckt nun maschinelles Lernen, Datenmining und großes Sprachmodelltraining ab. Das Wort "einschließlich" erscheint vor einer Liste von Verwendungen, die nicht existierten, als das Journal das Werk zuerst veröffentlichte. Der Autor hat eine Frage: Habe ich gerade mein Stipendium lizenziert, um eine KI zu trainieren, und warum hat niemand zuerst gefragt?
Akademische Verlage, die mit einem flachen Abonnementwachstum und den hohen Kosten für die Aufrechterhaltung von Zeitschriftplattformen konfrontiert sind, haben begonnen, den Zugang zu wissenschaftlichen Inhalten für die Ausbildung von KI zu verkaufen.Die Unternehmen auf der anderen Seite dieser Vereinbarungen sind Microsoft und andere Entwickler, die große Sprachmodelle bauen, die eine massive Korporation von zuverlässigen Texten benötigen, um ihre Ausgabe zu verbessern.
Die Verleger beschreiben diese Lizenzen als einen neuen Einnahmefluss, der Zeitschriften finanziell nachhaltig hält. Autoren und wissenschaftliche Gesellschaften beschreiben etwas, das einer Überraschung näher kommt: Inhalte, die vor Jahren in redaktionelle Systeme hochgeladen wurden, werden jetzt als Schulungsdaten verpackt, oft unter Verträgen, die Autoren nie gesehen haben, mit Lizenzgebührenbedingungen, die unklar bleiben und Opt-Out-Fristen in Portaleinstellungen begraben.
Wie die Deals funktionieren
Taylor & Francis, im Besitz von Informa, wurde das sichtbarste Beispiel im Jahr 2024, als The Bookseller berichtete, dass das Unternehmen einen AI-Datenvertrag mit Microsoft unterzeichnet hatte. Der Herausgeber sagte später, Autoren könnten sich entscheiden, bevor ihre Arbeit verwendet wird, aber viele Forscher lernten von der Vereinbarung durch die Presse und nicht vom Herausgeber.
Wiley hat über die Einnahmen aus der Lizenzierung von KI in der öffentlichen Investorenkommunikation diskutiert, und Cambridge University Press & Assessment hat Grundsätze veröffentlicht, die besagen, dass es bestimmte akademische Werke für die Ausbildung von AI lizenzieren kann, es sei denn, die Autoren entscheiden sich dafür.
Zahlungsstrukturen sind selten öffentlich. Einige Verleger haben gesagt, dass Autoren einen Anteil an Lizenzierungseinnahmen erhalten werden. Andere haben die Vereinbarungen als Teil der allgemeinen Operationen behandelt, ohne die Entschädigung des Autors anzugeben. Da das Geld zusammengefasst ist und die Vereinbarungen vertraulich sind, haben Autoren keine einfache Möglichkeit zu wissen, ob ihr bestimmter Artikel enthalten war, welches Modell es benutzte oder wie viel ein einzelnes Papier beigetragen hat.
Warum Forscher zurückstoßen
DieVerfasser Guildhat Verlage vor der Behandlung von KI-Klauseln als Routine-Kesselplatte gewarnt.Gesellschaft der Autorenhat gefordert, dass Autoren um ausdrückliche Zustimmung gebeten werden, bevor ihre Arbeit in ein Trainingskorpus eintritt, und eine Umfrage der Autors' Licensing and Collecting Society fand heraus, dass die meisten Autoren glauben, dass sie gefragt und bezahlt werden sollten, wenn ihre Arbeit zur Ausbildung von KI-Systemen verwendet wird.
Diese Rückmeldung ist weit über individuelle Beschwerden hinausgegangen.Wie AcademicJobs in seiner Berichterstattung überAutor Backlash auf AI Lizenzierung Deals, mehrere gesellschaftliche Zeitschriften entdeckten, dass ihre Verleger keine Redaktionsbüros konsultiert hatten oder den Deal als eine operative Angelegenheit außerhalb der akademischen Steuerung eingeführt hatten.
Geisteswissenschaftler befürchten, dass eine breite Lizenz einem Modell erlauben könnte, ein Argument ohne Zuweisung zu paraphrasieren oder zu reproduzieren. Biomedizinische Forscher machen sich Sorgen darüber, wie Trainingskörperschaften Tabellen, klinische Prüfungsberichte und annotierte ergänzende Datendateien behandeln.
Viele haben eigene Zeitschriften, aber lizenzieren Verlagsaktivitäten an große Häuser; Sie fragen sich jetzt, ob diese Häuser KI-Deals einseitig schlagen können, und ob Gesellschaftsmitglieder ein Wort haben sollten, bevor das Archiv, das sie gebaut haben, zu einem Trainingsgegenstand wird.
Was das Gesetz sagt und was es nicht tut
In den Vereinigten Staaten und dem Vereinigten Königreich schützt das Urheberrecht den spezifischen Ausdruck in einem Artikel oder Buch, nicht die zugrunde liegenden Fakten oder Ideen. Ein Verleger, der das Urheberrecht in einem Werk besitzt oder kontrolliert, kann im Allgemeinen eine Lizenz erteilen, die für eine neue Verwendung funktioniert, sofern der Vertrag sie unterstützt. Aber viele ältere Verlagsvereinbarungen erwähnen keine großen Sprachmodelle, maschinelles Lernen oder Text- und Datenmining.
Die Europäische Union hat eine engere gesetzliche Ausgrenzung.Artikel 4EU UrheberrechtsrichtlinieText- und Datenmining für kommerzielle Zwecke erlaubt, es sei denn, Rechteinhaber haben das Recht ausdrücklich in maschinell lesbarer Weise vorbehalten.Ein Verleger oder Autor, der Rechte vorbehalten hat, kann sich daher auf der Ebene des Materials selbst abmelden, aber die praktische Wirkung hängt davon ab, ob die Vorbehaltung nachträglich von Datenmaklern und Modellentwicklern geehrt wird.
Die Authors Guild und einzelne Schriftsteller haben OpenAI und andere verklagt, indem sie argumentierten, dass die Verwendung nicht autorisierter Sammlungen und Bücher zu Urheberrechtsverletzungen führt. Diese Fälle lösen die Frage der Verlage-Lizenzierung nicht direkt, aber ihr Ergebnis wird die Ausbildungslizenz bestimmen. Wenn die Gerichte feststellen, dass die Ausbildung in urheberrechtlich geschützten Werken ohne Lizenz fair ist, könnte der Wert dieser Verlagevereinbarungen geschwächt werden.
Potenzielle Rechtsstreitigkeiten gegen Verleger liegen in einem anderen Bereich: Vertragsrecht. Autoren, die der Ansicht sind, dass ein Verleger die in einer Verlagsvereinbarung gewährten Rechte überschritten hat, können Vertragsverletzungen verklagen, erklärende Urteile anstreben oder Vorhandenseinsschreiben ausstellen, in denen Rechnungslegung der Lizenzgebühren gefordert wird.Da viele Vereinbarungen durch unterschiedliche nationale Gesetze geregelt sind und Schiedsklauseln enthalten, wird jeder Streit eher als eine Reihe privater Ansprüche als als als eine Reinklasse-Aktion gelöst.
Photo by Brett Jordan on Unsplash
Das Vertragsproblem versteckt sich in Sicht
Sehen Sie sich eine typische Urhebervereinbarung aus dem Jahr 2012 an. Es gewährt dem Verlag das Recht, den Beitrag in allen Formaten und Medien zu reproduzieren, zu verteilen und zu sublizenzieren, die jetzt bekannt sind oder später entwickelt werden. Ein Anwalt eines Verlages wird diese Klausel als die Abdeckung von KI-Training lesen. Ein Autor wird sie als die Abdeckung von E-Books und Datenbanken lesen. Weder kann man sicher sein, weil kein Gericht die Klausel in dieser Einstellung interpretiert hat, und die Verträge sagen normalerweise nichts über Schulungsdaten, Zuweisung oder Widerruf des Autors.
Einige neuere Verträge versuchen, die Zweideutigkeit zu beseitigen. Taylor & Francis und Cambridge University Press haben Klauseln eingeführt, die sich direkt auf AI-Training beziehen und Opt-Out-Optionen festlegen. Aber das Framing ist wichtig. Ein Opt-Out-System legt den Schwerpunkt auf den Autor, Publisher-Ankündigungen zu überwachen und mit einer Frist zu reagieren. Das ist ein vertrautes Muster aus Open Access-Übergangsabkommen, und es neigt dazu, die Stimmen zu verstärken, die bereits Lizenzierung verstehen, während ruhigere Gruppen standardmäßig eingeschrieben werden.
Forscher an Institutionen mit starken Urheberbehörden haben begonnen, um Master-Veröffentlichungsvereinbarungen zu bitten, die KI-Rechte für den Autor vorbehalten, es sei denn, separat verhandelt.Einige europäische Universitäten beraten nun die Fakultät, einen Fahrer zu Zeitschriftverträgen hinzuzufügen: Die Arbeit kann in der Zeitschrift veröffentlicht werden, aber der Autor behält das Recht, die kommerzielle Verwendung von maschinellem Lernen zu kontrollieren.
Was in einer Vereinbarung zu suchen ist:
- Erwähnt der Vertrag große Sprachmodelle, maschinelles Lernen oder Text- und Datenmining?
- Wird die Verwendung von KI als gesondertes Recht behandelt, das eine separate Zahlung erfordert, oder in bestehende Sublicensing-Sprachen gefaltet?
- Gilt der Opt-Out nur für zukünftige Arbeiten oder für Archive, die bereits im System des Herausgebers vorhanden sind?
- Was passiert mit der Klausel, wenn Sie ablehnen, und wie lange müssen Sie antworten?
Was ein Forschungsbüro jetzt tun kann
Universitätsforschungsbüros können diesen Monat einen konkreten Schritt unternehmen. Fügen Sie Ihrer Vorveröffentlichungs-Checkliste eine einzige Frage hinzu: erwähnt diese Vereinbarung AI-Training oder maschinelles Lernen, und was passiert, wenn Sie ablehnen? Für viele Autoren wird die Antwort sein, dass der Herausgeber das Problem nie erhoben hat. Für einige wird es ein Checkbox sein, die sie verpasst haben. Machen Sie es sichtbar, bevor der Vertrag unterzeichnet wird, nicht nachdem das Trainingskorpus gebaut wurde.
Es geht auch darum, ob Gelehrte wissen und ein Wort darüber haben, was mit der Aufzeichnung passiert, die sie jahrelang aufgebaut haben.Verlage, die das Arrangement in einfacher Sprache lesbar machen, mit echten Opt-Outs und einem fairen Anteil an Einnahmen, werden viel weniger von der Kontrolle konfrontiert sein, die jetzt ihren Weg führt.
