Academic Jobs - Home of Higher Ed Logo

KI-Integration und Richtlinien für akademische Integrität spalten sich auf - Institution für Institution

Postet eine Geschichte
204Ansichten
Native advertising — guest articles from $400See packages
a magnifying glass sitting on top of a piece of paper
Photo by Vlad Deep on Unsplash

Die weniger vorhersehbare ist, dass Universitäten aufgehört haben, so zu tun, als könnten sie eine einzige Regel für AI-Integration und akademische Integritätsrichtlinien schreiben. Die alte Integritätsmaschine lief auf einem gemeinsamen Skript: Plagiat ist die unbefugte Verwendung von Worten oder Ideen einer anderen Person.

Was stattdessen auftaucht, ist ein Patchwork, manchmal in einem Gebäude. Ein Chemie-Kurs erlaubt KI für das Codieren von Skripten; ein Geschichtsseminar verbietet es für das Aufstellen von Essays. Die Zentralverwaltung bittet die Fakultät, ihre Entscheidungen in einer Lehrplanbox zu melden, die niemand überprüft. Diese Fragmentierung, mehr als jeder einzelne Skandal, ist die wahre politische Geschichte von 2023 bis 2026.

Ein globales Patchwork von Regeln, nicht eine einzige Politik

Turnitin schaltete seinen Indikator für das Schreiben von KI im April 2023 ein und versprach einen Vertrauenswert, der wahrscheinlich von einem großen Sprachmodell produzierten Text markieren würde. Im August desselben Jahres schaltete die Vanderbilt University das Feature für neue Studentenanträge aus, eine der ersten Forschungsuniversitäten, die dies öffentlich taten. Bis September 2023 hatte die UNESCO globale Leitlinien für generative KI in Bildung und Forschung herausgegeben, und die Russell Group, die 24 Forschungsintensive britische Universitäten vertritt, hatte bereits fünf gemeinsame Prinzipien veröffentlicht, die KI-Literatur als Teil des Lehrplans behandelten, anstatt eine Bedrohung für sie.

Die Spaltung zwischen diesen Bewegungen erzählt die Geschichte. Der Verkäufer bot die Erkennung an. Eine Universität lehnte ab. Die Branchenorgane bat um Prinzip, nicht um Verbot. Selbst die frühen Verbote waren ungleich: Sciences Po in Paris beschränkte ChatGPT in Bewertungen ohne vorherige Genehmigung im Januar 2023, während andere Institutionen dieses Semester anstelle von Regeln anhand von Leitlinien verbrachten. Das Ergebnis ist kein Konsens; es ist ein ausgehandelter Waffenstillstand, der sich von Seminar zu Seminar unterscheidet.

Statue of justice holding scales against blue background

Photo by Sasun Bughdaryan on Unsplash

Hier ist der Fang: Detektion ist das schwache Gelenk

Die Werkzeuge, die wie die Durchsetzungsrücken aussahen, haben sich als der am wenigsten zuverlässige Teil des Stacks erwiesen. Detektoren geben eine Zahl zurück, und eine Zahl fühlt sich autoritativ an. Die Beweise sagen anders. In einer 2023-Studie, die von Forschern der Stanford University geleitet wurde und in Patterns veröffentlicht wurde, haben sieben weit verbreitete GPT-Detektoren 61 Prozent der 91 TOEFL-Essays, die von Nicht-Englischsprachigen als AI-generiert geschrieben wurden, falsch eingestuft. Die gleiche Studie machte einen Punkt, an dem jedes Verhaltenspanel lesen sollte: falsche Positive fallen nicht gleichmäßig; sie landen am härtesten auf Autoren, deren Englisch nicht mit den Schulungsdaten des Modells übere

Es war keine Behauptung, dass jede Anklage falsch ist.Es war eine Demonstration, dass die Fehlerquote unter den Schülern konzentriert ist, die am wenigsten wahrscheinlich sind, institutionelle Macht zu haben, um zurückzuziehen.

Eine separate theoretische Analyse von Computerwissenschaftlern der University of Maryland argumentierte, dass die zuverlässige Erkennung von KI-generierten Texten nicht nur schwierig, sondern grundsätzlich instabil ist, wenn Modelle verbessert werden.Stanford-geführte Detektorbias-StudieUnd dieMaryland Analyse der Detektorgrenzensind die zwei Beweise geworden, die am häufigsten in Campus-Debatten zitiert werden, ob die Tools eingeschaltet bleiben sollen.

Turnitins eigene Anleitung sagt, dass die Punktzahl eine Untersuchung informieren sollte, nicht eine abschließen. Dennoch kommt die Punktzahl oft in der Inbox eines Lehrers mit dem gleichen visuellen Gewicht wie ein Ähnlichkeitsbericht, und diese Lücke zwischen Anleitung und Gewohnheit ist, wo die meisten Fehlverhaltensfehler beginnen.

Was die Universitäten tatsächlich auf dem Papier verändert haben

Im gesamten Patchwork erscheinen vier Positionen: harte Einschränkung, bedingte Verwendung mit Offenlegung, Kurs-für-Kurs-Delegation und Bewertungs-Neugestaltung.Die Namen und Termine unten zeigen, wie schnell sich diese Positionen auf der ganzen Welt bewegen.

Institution oder GruppeDatumPositionierung
Wissenschaft PoJanuar 2023ChatGPT in Bewertungen eingeschränkt, es sei denn, ein Dozent hat es ausdrücklich erlaubt.
TurnierenApril 2023Ein AI-Writing-Indikator für Institutionen mit seinem Ähnlichkeitswerkzeug eingeführt.
Russell Group UniversitätenJuli 2023Veröffentlicht fünf Prinzipien zur Unterstützung der KI-Alphabetisierung und der Entscheidungsfindung auf Kursebene.
Vanderbilt UniversitätAugust 2023Disabled Turnitins AI-Detektor für neue Einreichungen, unter Berufung auf Zuverlässigkeitsprobleme.
UnescoSeptember 2023Ausgegebene Leitlinien, die eine menschenorientierte, inklusive Verwendung mit klarer Rechenschaftspflicht fordern.

Als Turnitin den Detektor einschaltete, sagte das Unternehmen, dass etwa 3 Prozent der Studentenpapiere in ihrer ersten Stichprobe 80 Prozent oder mehr KI-geschriebenen Text zeigten.

Nach diesen frühen Schritten verschoben sich die schwierigeren Fragen auf das Bewertungsdesign. Die Institutionen, die den Detektor gehalten haben, haben es oft mit einem Prozess gepaart: Eine markierte Punktzahl löste ein Gespräch aus, nicht eine automatische Ladung.Die Universität von Glasgow veröffentlichte zum Beispiel eine Anleitung, in der die Schüler verlangten, zu erklären, wie sie generative KI verwendeten und das Personal zu informieren, wenn unbefugte Verwendung ein Fehlverhalten darstellen würde.Leitfaden der UNESCOEs bleibt ein nützlicher Bezugspunkt, da es Politik mit Einbeziehung, Datenschutz und der Notwendigkeit einer menschlichen Überprüfung anstelle eines algorithmischen Urteils verbindet.

a close up of a typewriter with a paper on it

Photo by Markus Winkler on Unsplash

Hype versus Realität: Eine Scorecard

Vier Ansprüche haben das Gespräch angetrieben. Keiner hat den Kontakt mit der Campuspraxis unverändert überlebt.

  • Die Behauptung:AI-Detektoren können KI-generierte Arbeiten mit hoher Genauigkeit identifizieren.Die Realität:Sie erzeugen einen Vertrauenswert, der mit Modellupdates verschiebt und nicht-englischsprachiges Schreiben mit hohen Raten falsch klassifiziert, weshalb mehrere Institutionen sich weigern, den Punkt als Beweis zu verwenden.
  • Die Behauptung:Die Universitäten haben jetzt klare, einheitliche KI-Politiken.Die Realität:Die Richtlinien sind auf der Ebene eines einzelnen Kurses oder einer Abteilung klar und widersprüchlich; der Standard ist eine Reihe lokaler Entscheidungen.
  • Die Behauptung:Das Verbot der generativen KI wird die Integrität der Bewertung schützen.Die Realität:Blattverbote sind fast nicht durchsetzbar, weil dieselben Tools in Textverarbeitern und Suchmaschinen eingebettet sind, und Detektion kann die Durchsetzung nicht zuverlässig unterstützen.
  • Die Behauptung:Die Verwendung von KI zu erlauben, wird eine Welle unantastbarer Ghostwriting verursachen.Die Realität:Das häufigere Problem ist ungekündigte Hilfe im Maßstab, was ein Offenlegungsproblem ist, kein Erkennungsproblem.

Universitäten, die das Problem als Offenlegungsproblem behandeln, verbringen ihre Energie auf neue Bewertungsformate und klare Anweisungen. Universitäten, die es als Erkennungsproblem behandeln, verbringen ihre Energie, um einen Punkt zu verteidigen.

Was der nächste politische Zyklus eigentlich sein wird

Wenn der erste politische Zyklus über Erkennung ging, dreht sich der zweite um Beweise. Leitungspläne benötigen einen Beweisstandard, der sich nicht auf einen proprietären Algorithmus stützt, den niemand überprüfen kann. Fakultät benötigt Bewertungsdesigns, die Arbeit belohnen, die eine KI nicht allein tun kann, und sie brauchen Zeit, um sie neu zu gestalten.

Das Problem war nie der Detektor. Es ist die fünfzehn Minuten pro gekennzeichneten Aufsatz, für den niemand budgetiert. Eine Punktzahl kommt, ein Student antwortet mit ihrer Bearbeitungsgeschichte, und ein Lehrer, der bereits vier Kurse unterrichtet, wird gebeten, eine proprietäre Zahl gegen eine menschliche Erklärung zu wiegen.

Für Wissenschaftler, die an Universitäten suchen, die einstellen, ist der praktische Test einfach. Fragen Sie, was passiert, wenn ein Detektor den Essay eines Studenten markiert. Eine gute Antwort beschreibt ein Gespräch und einen zweiten Leser. Eine schlechte Antwort beschreibt eine Schwelle. Die Stanford-geführten Autoren der Detektorbias-Studie setzen die Warnung klar: falsche Positiven riskieren, die Schriftsteller selbst zu bestrafen, die Werkzeuge sollen geschützt werden.

Porträt von Dr. Oliver Fenton
Über den Autor

Dr. Oliver FentonAutor ansehen

Academic Jobs In House Author

Diskussionen

Sort von:

Seien Sie der Erste, der diesen Artikel kommentiert!

Du bist

Sie werden gebeten, sich anzumelden, bevor Ihr Kommentar veröffentlicht wird.

Neue0 comments

Treten Sie dem Gespräch bei!

Fügen Sie jetzt Ihre Kommentare hinzu!

Haben Sie Ihr Wort

Engagement Ebene

Browse nach Fakultät

Browse nach Thema

Frequently Asked Questions

🎓Was ist akademische Integrität im Kontext generativer KI?

Die akademische Integrität konzentriert sich nun darauf, die Arbeit, die ein Student tatsächlich selbst erstellt hat, von Texten, Code oder Ideen zu unterscheiden, die mit Tools wie ChatGPT, Claude oder Gemini generiert wurden. Die meisten Institutionen definieren sie als ehrliche Darstellung der Autorenschaft, einschließlich der klaren Offenlegung der Nutzung von KI, wenn diese Nutzung erlaubt ist. Das Schwierige daran ist, dass vernünftige Menschen unterschiedlicher Meinung sind, ob die Verwendung von KI für Grammatikkorrekturen dasselbe ist wie die Verwendung für das Verfassen eines Essays.

🏛️Warum hat die Vanderbilt University den KI-Detektor von Turnitin deaktiviert?

Die Vanderbilt-Universität hat im August 2023 die künstliche Intelligenz-basierte Plagiatsprüfung von Turnitin für neue Studierenden-Einreichungen deaktiviert und dabei Bedenken hinsichtlich der Zuverlässigkeit und falsch positiver Ergebnisse genannt. Diese Entscheidung war wichtig, da Vanderbilt eine der ersten Forschungsuniversitäten war, die diesen Schritt öffentlich bekannt gab, und damit signalisierte, dass ein bedeutender Kunde das Vertrauensniveau für Entscheidungen über Fehlverhalten nicht als ausreichend erachtete.

⚖️Sind AI-Textdetektoren zuverlässig genug für Fälle von wissenschaftlichem Fehlverhalten?

Nein. Eine in Patterns veröffentlichte Studie fand heraus, dass sieben weit verbreitete GPT-Detektoren 61 Prozent von 91 TOEFL-Essays, die von nicht-muttersprachlichen Englischsprechern verfasst wurden, fälschlich als künstlich generiert einstuften. Eine separate Analyse der University of Maryland argumentierte, dass eine zuverlässige Erkennung grundlegend instabil wird, wenn generative Modelle verbessert werden. Die meisten Richtlinien zum wissenschaftlichen Fehlverhalten behandeln Detektorscores jetzt als Ausgangspunkt für Gespräche, nicht als Beweis.

🚫Funktionieren generelle Verbote von generativer KI?

Selten. Generelle Verbote sind schwer durchzusetzen, da generative KI in Textverarbeitungsprogrammen, Suchmaschinen und Zitierwerkzeugen eingebettet ist und Detektoren den Text nicht zuverlässig identifizieren können. Institutionen, die ein vollständiges Verbot versuchen, stellen oft fest, dass es sich auf ein Ehrensystem ohne die erforderlichen Beweise für ein Verhaltensgremium reduziert.

📋Was müssen Studierende typischerweise nach den AI-Richtlinien der Universität offenlegen?

Die gängige Anforderung ist die Offenlegung aller im Rahmen der eingereichten Arbeiten verwendeten KI-Tools, einschließlich des Tools, seiner Verwendung und der betroffenen Teile der Einreichung. Einige Universitäten verlangen dies für alle Prüfungen, andere überlassen die Entscheidung dem Kursleiter. Die Nichtoffenlegung wird in der Regel als wissenschaftliches Fehlverhalten behandelt.

🤖Was ist der Unterschied zwischen KI-unterstützter und KI-generierter Arbeit?

AI-unterstützte Arbeit bedeutet, dass ein Student ein Werkzeug zur Unterstützung verwendet hat, wie zum Beispiel Quellen zusammenzufassen, Grammatik zu überprüfen oder Code zu verfeinern, während AI-generierte Arbeit bedeutet, dass das Werkzeug den Kerninhalt produziert hat, den der Student dann abgegeben hat. Die meisten Richtlinien erlauben das Erste unter bestimmten Umständen und verbieten das Zweite, es sei denn, eine Bewertung fordert es explizit.

📝Wie ändern Universitäten die Bewertungen aufgrund von generativem AI?

Viele Campus sind dabei, zu mündlichen Prüfungen, schriftlichen Arbeiten im Unterricht, gestaffelten Entwürfen, projektbasierten Arbeiten und Bewertungen überzugehen, bei denen die Studierenden aufgefordert werden, die Ausgabe einer KI zu bewerten. Ziel ist es, den Wert der nicht deklarierten Nutzung von KI zu verringern, indem der Denkprozess sichtbar gemacht wird. Die Neugestaltung von Bewertungen erfolgt langsam, da sie eine Entlastung der Arbeitsbelastung erfordert, die viele Institutionen nicht finanziert haben.

🌍Was besagt die UNESCO-Richtlinie von 2023 zu generativer KI im Bildungsbereich?

Die UNESCO-Richtlinie von September 2023 fordert Regierungen und Institutionen auf, menschliche Handlungsfähigkeit, Inklusion, Gleichberechtigung und Rechenschaftspflicht bei der Nutzung von KI im Bildungsbereich in den Mittelpunkt zu stellen. Sie weist auch auf Bedenken hinsichtlich des Datenschutzes und des Urheberrechts hin und fordert eine menschliche Überprüfung von automatisierten Entscheidungen anstatt eines algorithmischen Urteils über Studierende.

📚Was sollten Dozenten in eine Lehrveranstaltungsbeschreibung über KI aufnehmen?

Eine nützliche Lehrveranstaltungsbeschreibung nennt die erlaubten oder verbotenen Tools, erläutert den Grund im Zusammenhang mit den Lernzielen, nennt die Offenlegungspflicht und beschreibt, was passiert, wenn ein Detektor eine Arbeit markiert. Die klarsten Aussagen informieren die Studierenden auch darüber, ob sie KI für Brainstorming, Programmierung, Bearbeitung oder überhaupt nicht verwenden dürfen.

🛡️Was passiert, wenn ein Detektor eine Hausarbeit eines Studenten fälschlich markiert?

Ein guter Prozess gibt dem Studenten die Möglichkeit, zu erklären, seine Entwurfsgeschichte zu dokumentieren und vor einer Feststellung von Fehlverhalten mit einem Dozenten oder einem zweiten Gutachter zu sprechen. Richtlinien, die eine Punktzahl als Schwellenwert für eine automatische Weiterleitung behandeln, führen zu der höchsten Anzahl von falschen Anschuldigungen und konzentrieren diese Schäden bei mehrsprachigen Autoren.

🔎Welche externen Rahmenbedingungen sollten Administratoren zuerst lesen?

Die am häufigsten zitierten Ausgangspunkte sind die UNESCO-Richtlinien zu generativer KI in Bildung und Forschung und die fünf Grundsätze der Russell Group für KI im Unterricht. Forschungsergebnisse zur Zuverlässigkeit von Detektoren aus der von Stanford geleiteten Studie in Patterns und der Analyse der University of Maryland sollten neben jeder Beschaffungsentscheidung stehen.

📡Wo können Akademiker Trends in der Universitäts-KI-Politik verfolgen?

Folgen Sie den Lehrzentren der Institutionen, den Büros für akademische Integrität und den Branchenorganisationen, da sie die Richtlinienaktualisierungen vor der Änderung der offiziellen Regelbücher veröffentlichen. Akademische Stellenbörsen zeigen auch, wo Institutionen für Rollen einstellen, die von KI und akademischer Integrität betroffen sind, was ein praktisches Signal dafür ist, wie ernst ein Campus das Thema behandelt.