Professor versteckt weiße Schrift in der Prüfung – und enttarnt 32 AI-Schummler
TL;DR
32 von 35 Studenten aus zwei Klassen sind durch einen Teil ihrer Zwischenprüfung gefallen – alle mit derselben Masche. Der Professor hatte in der Aufgabenstellung eine Anweisung in weißer Schrift versteckt: für das Auge unsichtbar, aber lesbar für jedes Sprachmodell, in das der Text hineinkopiert wird. Wer die Antwort von einer AI schreiben ließ, lieferte die versteckte Anweisung brav mit ab und war überführt. Der Trick kostet nichts und funktioniert überall dort, wo Text digital weitergereicht wird.
Nauti's Take
Ein billiger, wirksamer Fortschritt für alle, die Textabgaben bewerten: keine teure Detektor-Software, keine Fehlalarme gegen ehrliche Leute, nur eine getarnte Zeile im Dokument. Das Risiko läuft in beide Richtungen – dieselbe Prompt-Injection-Technik lenkt Modelle auch dann, wenn sie Lebensläufe, Angebote oder Verträge lesen.
Für Lehrende ein Gratis-Werkzeug, für alle anderen die Frage, wem sie fremde Dokumente ungeprüft vorsetzen.