News

KI-Training mit Büchern: Urheberrechtliche Grenzen und die Frage nach Europas digitalem Wissen

KI und Urheberrecht - Rechtsanwalt - ORF ZiB 2
KI Training mit antiquarischen Büchern - Was sagt das Urheberrecht?

Dürfen KI-Unternehmen Bücher ohne Zustimmung der Urheber digitalisieren und als Trainingsdaten verwenden? Das Urheberrecht setzt klare Grenzen. Doch die massenhafte Digitalisierung europäischer Wissensbestände wirft eine größere Frage auf: Wer kontrolliert Europas digitales Wissen und wer zieht daraus den wirtschaftlichen Nutzen?

Vom antiquarischen Buch zum Trainingsmaterial für KI

In den USA wurde zuletzt über systematische Ankäufe und die Digitalisierung großer Buchbestände durch KI-Unternehmen berichtet. Auch in Österreich stellt sich mittlerweile die Frage, ob antiquarische Bücher in größerem Umfang angekauft werden, um deren Inhalte zu digitalisieren und für KI-Systeme nutzbar zu machen.

Rechtlich muss dabei zwischen dem Eigentum am Buch und den Rechten am darin enthaltenen Werk unterschieden werden. Wer ein antiquarisches Buch rechtmäßig kauft, wird Eigentümer dieses konkreten Exemplars. Das bedeutet nicht, dass damit die urheberrechtlichen Nutzungsrechte am enthaltenen Werk erworben werden. Die Digitalisierung eines urheberrechtlich geschützten Buches stellt eine Vervielfältigung dar. Das Vervielfältigungsrecht steht gemäß § 15 UrhG dem Urheber zu, soweit keine gesetzliche Ausnahme eingreift.

Der urheberrechtliche Schutz endet 70 Jahre nach dem Tod des Urhebers (§ 60 UrhG). Entscheidend ist daher nicht allein, wie alt ein Buch ist oder wann es erschienen ist. Auch ein mehrere Jahrzehnte altes antiquarisches Buch kann weiterhin urheberrechtlich geschützt sein.

Welche Ansprüche können Urheber haben?

Wird ein geschütztes Werk ohne Berechtigung digitalisiert und verarbeitet, sieht das österreichische Urheberrechteine Reihe möglicher Ansprüche vor. Dazu gehören insbesondere Unterlassungs- und Beseitigungsansprüche sowie Ansprüche auf angemessenes Entgelt und – bei schuldhaften Rechtsverletzungen – Schadenersatz beziehungsweise Herausgabe des Gewinns. Hinzu kommen unter bestimmten Voraussetzungen Rechnungslegungs- und Auskunftsansprüche, die Veröffentlichung eines Urteils sowie die Möglichkeit einstweiliger Verfügungen. Besonders interessant wird die Frage bei KI-Systemen: Ein Beseitigungsanspruch kann nicht nur die angefertigte digitale Kopie betreffen. Zu klären ist auch, ob und unter welchen Voraussetzungen rechtswidrig verwendete Werke aus Trainingsdaten oder anderen Datenbeständen eines KI-Systems entfernt werden müssen.

„Fair Use“ ist kein europäischer Freibrief

US-amerikanische Technologieunternehmen berufen sich bei der Nutzung urheberrechtlich geschützter Inhalte häufig auf das sogenannte Fair-Use-Prinzip. Dieses stammt aus dem US-amerikanischen Urheberrecht und erlaubt unter bestimmten Voraussetzungen die Nutzung geschützter Werke ohne Zustimmung des Rechteinhabers. Dabei werden unter anderem Zweck und Charakter der Nutzung, die Art des Werkes, der Umfang der Übernahme sowie die Auswirkungen auf den Markt des Originals berücksichtigt. Für KI-Anwendungen ist insbesondere die Frage relevant, ob eine Nutzung als „transformativ“ angesehen werden kann.

Ein bekanntes Beispiel ist Authors Guild v. Google, in dem das massenhafte Scannen von Büchern für eine Suchfunktion in den USA als Fair Use beurteilt wurde. Diese amerikanische Rechtslage lässt sich jedoch nicht einfach auf Österreich oder die Europäische Union übertragen. Eine allgemeine Fair-Use-Klausel nach US-amerikanischem Vorbild gibt es im europäischen Urheberrecht nicht. Gerade deshalb wird die europäische Diskussion über Text and Data Mining und die Nutzung urheberrechtlich geschützter Inhalte für das Training generativer KI in den kommenden Jahren erhebliche Bedeutung gewinnen.

Was passiert mit den Originalbüchern?

Medienberichte über die angebliche Zerstörung von Büchern nach ihrer Digitalisierung erzeugen Aufmerksamkeit. Für ein Gerichtsverfahren reichen Medienberichte oder bloße Behauptungen allerdings nicht aus. Es müsste konkret festgestellt werden, welche Bücher erworben wurden, ob sie tatsächlich digitalisiert wurden, wie die Digitalisate verwendet wurden und ob die physischen Exemplare anschließend tatsächlich vernichtet wurden. Urheberrechtlich ist dabei eine auf den ersten Blick überraschende Unterscheidung notwendig: Die Vernichtung eines rechtmäßig erworbenen physischen Buches ist grundsätzlich weniger problematisch als dessen unerlaubte Digitalisierung. Denn am konkreten Buch besteht Eigentum. Die darin verkörperten geistigen Inhalte können hingegen weiterhin urheberrechtlich geschützt sein.

Europa und die USA gehen unterschiedliche Wege

In den USA beschäftigen sich Gerichte bereits intensiv mit der Frage, unter welchen Voraussetzungen urheberrechtlich geschützte Werke zum Training von KI verwendet werden dürfen. In Europa ist die höchstgerichtliche Rechtsprechung zu vielen dieser Fragen noch nicht abschließend entwickelt. Verfahren und Beschwerden betreffen unter anderem die Verwendung geschützter Trainingsdaten, Transparenzpflichten, Datenschutz sowie zunehmend die Vorgaben des europäischen AI Act. Besonders relevant wird dabei die Frage sein, wie weit die europäischen Ausnahmen für Text and Data Mining reichen. Die kommenden gerichtlichen Entscheidungen werden daher nicht nur für Autoren und Verlage von Bedeutung sein. Sie werden wesentlich mitbestimmen, unter welchen Voraussetzungen europäisches Wissen künftig für die Entwicklung kommerzieller KI-Systeme verwendet werden darf.

Kann man sich gegen globale Technologiekonzerne überhaupt wehren?

Unternehmen wie Google oder Meta verfügen über enorme finanzielle und technische Ressourcen. Rechtlich stehen sie vor europäischen Gerichten jedoch grundsätzlich nicht über anderen Parteien. Dass Verfahren gegen große Technologiekonzerne erfolgreich geführt werden können, zeigen zahlreiche Beispiele. Auch Rechtsanwalt Dr. Öhlböck hat bereits Verfahren gegen Google erfolgreich geführt. Bereits 2016 musste Google nach einem Urteil des Landesgerichtes für Zivilrechtssachen Wien Inhalte aus dem Index der Suchmaschine Google entfernen. Zuletzt konnte 2025 die Entfernung einer negativen Google-Bewertung für einen von uns vertretenen Mandanten erreicht werden. Die Größe des Prozessgegners allein sollte daher kein Grund sein, berechtigte Ansprüche nicht zu prüfen.

Wenn öffentliches Wissen zum Rohstoff für KI wird

Grundsätzlicher wird die Diskussion bei großen öffentlichen Wissensbeständen. Bereits 2010 begann die Österreichische Nationalbibliothek gemeinsam mit Google mit der Digitalisierung urheberrechtsfreier Bestände. Bei gemeinfreien Werken bestehen keine Urheberrechte des ursprünglichen Autors mehr. Wenn aus umfangreichen digitalisierten Beständen jedoch neue Datenbanken entstehen und diese wiederum für KI-Anwendungen verwendet werden, können neue rechtliche Fragen auftreten. Unter anderem kann das Schutzrecht sui generis für Datenbanken gemäß §§ 76c und 76d UrhG relevant werden. Voraussetzung dafür ist insbesondere eine nach Art oder Umfang wesentliche Investition in die Beschaffung, Überprüfung oder Darstellung des Datenbankinhalts. Daneben kann bei einer eigentümlichen geistigen Auswahl oder Anordnung des Stoffes auch der Schutz als Datenbankwerk in Betracht kommen. Damit verschiebt sich die Fragestellung: Es geht nicht mehr ausschließlich darum, ob ein einzelnes historisches Werk urheberrechtlich geschützt ist. Es geht zunehmend darum, wer die Kontrolle über die daraus geschaffenen digitalen Wissensbestände besitzt und wer sie wirtschaftlich verwerten darf.

Wem gehört Europas digitales Gedächtnis?

Die Diskussion geht aber weit über Urheberrecht hinaus. Die großen Digital- und KI-Konzerne haben sich überwiegend in den USA etabliert. Europa verfügt über hervorragende Forschung, Unternehmen und spezialisierte technologische Lösungen, bei globalen digitalen Plattformen und großen KI-Modellen dominieren jedoch Unternehmen außerhalb Europas. Mit dieser Entwicklung verlagern sich nicht nur Kapital und Wertschöpfung. Es verlagern sich auch Wissen, technologische Kompetenz und die Kontrolle über zentrale digitale Infrastrukturen. Wenn europäische Bücher, Archive, Bibliotheken und andere Wissensbestände digitalisiert werden und anschließend als Grundlage für KI-Systeme außereuropäischer Unternehmen dienen, entsteht deshalb eine Frage, die weit über das Urheberrecht hinausgeht:

Wer kontrolliert künftig das digitalisierte Wissen Europas?

Die Antwort findet sich teils auch in unserer Geschichte. Wissen ist immer gewandert. Die Verlagerung von Wissen und technologischer Führerschaft ist historisch kein neues Phänomen. Wissen wurde über Jahrhunderte übernommen, übersetzt, weiterentwickelt und in neue politische und wirtschaftliche Machtzentren übertragen. Vieles aus der griechischen Welt fand Eingang in die römische Kultur und wurde dort bewahrt und transformiert, während sich gleichzeitig die politischen Kräfteverhältnisse grundlegend verschoben. Später verlor Rom seine beherrschende Stellung. Solche historischen Entwicklungen lassen sich nicht unmittelbar mit der heutigen digitalen Transformation gleichsetzen. Sie zeigen jedoch, dass die Zentren von Wissen, wirtschaftlicher Macht und technologischer Entwicklung keineswegs dauerhaft an einem Ort bleiben.

Eine europäische Zeitenwende?

Eine Frage ist: Erleben wir gegenwärtig eine solche Verschiebung? Nicht als Wiederholung der Geschichte, sondern als eine Zeitenwende, in der sich entscheidet, wo künftig Wissen, technologische Kompetenz und damit wirtschaftliche und politische Gestaltungsmacht konzentriert sein werden. Europa steht deshalb vor einer Aufgabe, die größer ist als die Regulierung einzelner KI-Unternehmen. Es muss gelingen, Urheber und Rechteinhaber wirksam zu schützen, gleichzeitig Forschung und Innovation zu ermöglichen und europäische Wissensbestände für kommende Generationen digital nutzbar zu machen. Vor allem aber sollte Europa darauf achten, nicht lediglich zum Lieferanten des Rohstoffs zu werden, auf dessen Grundlage anderswo die wertvollsten Technologien der Zukunft entstehen.

Denn im Zeitalter der Künstlichen Intelligenz ist Wissen nicht nur Kulturgut. Wissen ist Infrastruktur, wirtschaftlicher Rohstoff und letztlich auch eine Frage technologischer Souveränität.