6 / 3593

Oxford lässt OpenAI mit Texten der Bodleian Library trainieren

TL;DR

Die University of Oxford hat OpenAI erlaubt, seine AI-Modelle mit historischen Texten aus der Bodleian Library zu trainieren. Das geht laut The Guardian aus internen Dokumenten hervor. Das von OpenAI digitalisierte Material floss demnach in den Trainingsdatensatz des Unternehmens, während Tech-Firmen gezielt bei Hochschulen nach frischen Daten suchen. Mitarbeitende der Universität warnen vor einem Reputationsrisiko durch die Partnerschaft mit dem ChatGPT-Anbieter.

Nauti's Take

Historische Bestände digital zugänglich zu machen, ist eine echte Chance: Alte Texte werden durchsuchbar, und Modelle lernen Sprache und Wissen jenseits des heutigen Internets. Das Risiko liegt in den Bedingungen, denn bekannt wurde der Deal erst über interne Dokumente, und eine Universität gibt Kulturgut an einen kommerziellen Anbieter.

Bibliotheken und Archive im DACH-Raum sollten solche Kooperationen nur mit offenen Verträgen und eigenen Nutzungsrechten an den Digitalisaten eingehen.

Quellen