Zusammenfassung der Kerninhalte
Anthropic musste 1,5 Milliarden US-Dollar als Entschädigung zahlen, um das AI-Modell Claude mit gestohlenen Büchern zu trainieren (etwa 500.000 Werke, jeweils ca. 3.000 US-Dollar pro Werk). Dies ist die größte Urheberrechtsvereinbarung der AI-Ära. Der entscheidende Punkt ist jedoch folgender: Es handelt sich um eine „Entschädigung für gestohlene Daten“ und nicht um eine „Lizenzgebühr für legales Training“. Die Vereinbarung stellt keinen bindenden Rechtspräzedenzfall dar; die tatsächlichen Gewinne der Autoren sind begrenzt. Der US-Kongress arbeitet derzeit an Gesetzen, die AI-Unternehmen verpflichten, ihre Trainingsdaten offenzulegen, wodurch die zukünftigen Urheberrechtsregeln für das AI-Training weiterhin unklar sind.
1. 1,5 Milliarden US-Dollar sind eine „Urheberrechtsstrafe“, keine „Gebühr für das AI-Training“
Um diese Vereinbarung zu verstehen, ist es wichtig, auf das Urteil eines Richters aus dem Jahr 2025 zurückzublicken: Wenn AI mit legalen Daten trainiert wird (z. B. durch Scannen von gedruckten Büchern), gilt dies als „angemessene Nutzung“ und erfordert keine Zahlung. Das Herunterladen und Speichern von mehr als 7 Millionen Büchern aus Piratensuchsystemen wie LibGen stellt jedoch einen klaren Urheberrechtsverstoß dar.
Warum war Anthropic bereit, 1,5 Milliarden US-Dollar zu zahlen? Laut dem US-Urheberrecht beträgt die Höchstentschädigung für vorsätzlichen Rechtsverstoß 150.000 US-Dollar pro Werk – bei 7 Millionen Werken wären dies insgesamt 1 Billion US-Dollar! Die Zahlung von 1,5 Milliarden US-Dollar diente dazu, das Risiko einer „unerschwinglichen“ Entschädigung zu vermeiden.
Die Gebühr von 3.000 US-Dollar pro Werk ist somit keine Lizenzgebühr für das AI-Training, sondern eine Entschädigung für die Nutzung gestohlener Daten. Wenn AI-Unternehmen mit legalen Daten trainieren würden, müssten sie den Autoren möglicherweise überhaupt nichts zahlen.
2. Diese Vereinbarung stellt keinen „rechtskräftigen Beschluss“ dar; andere Fälle können noch geklärt werden
Anthropic behauptet, gewonnen zu haben, weil der Richter feststellte, dass das Training mit legalen Daten als angemessene Nutzung gilt. Nach US-Recht ist jedoch erst ein endgültiges Urteil eines Berufungsgerichts bindend. Diese Vereinbarung ist lediglich das Ergebnis einer vorprozessualen Phase; die Meinung des Richters ist nur referenziell und nicht rechtsgültig.
Es laufen derzeit noch zahlreiche AI-Urheberrechtsverfahren: Ein Gericht in New York prüft den Fall Google Gemini, ein Gericht in Kalifornien den Fall Meta – die Ansichten der Richter variieren. Einige Richter befürchten, dass das AI-Training die Arbeitsplätze von Autoren gefährden könnte, was im Widerspruch zu den Argumenten des Richters in diesem Fall steht.
Noch wichtiger ist, dass sich sechs Autoren aus der Vereinbarung zurückgezogen und eigene Klagen eingereicht haben, ebenso wie 350 große Verlage und Rechteinhaber, die auf eine höhere Entschädigung hoffen. Dies zeigt, dass niemand mit dem Ergebnis vollständig zufrieden ist.
3. Die Autoren verdienen nicht viel; das Geld wird mehrfach abgezogen
Von den 1,5 Milliarden US-Dollar erhalten die Autoren nur einen kleinen Anteil:
- Kostenabzug: Zunächst werden 122 Millionen US-Dollar für Anwaltskosten, Prozesskosten und Verwaltungskosten abgezogen (bei den ursprünglichen Forderungen der Anwälte könnten es bis zu 25–30 % sein).
- Verteilung mit den Verlagen: Der verbleibende Betrag wird zwischen Autoren und Verlagen geteilt.
- Geringere Gewinne für kleine Autoren: Da große Verlage aus der Vereinbarung ausgestiegen sind, erhalten die meisten Autoren nur etwa 1.500 US-Dollar pro Werk – weniger als 2 % der gesetzlichen Höchstentschädigung.
Viele Autoren sind unzufrieden: Entweder halten sie die Entschädigung für zu niedrig oder die Verteilung für ungerecht (da kleine Autoren genauso viel erhalten wie große Verlage). Das ist keine „Siege“ – es handelt sich eher um einen kleinen Teil der ursprünglichen Forderungen nach Urheberrechtsverletzung.
4. Der Kongress will die „Blackbox des AI-Trainings“ öffnen; die Zukunft wird schwieriger
Der US-Kongress arbeitet an zwei Gesetzen, deren Ziel es ist, AI-Unternehmen dazu zu verpflichten, ihre Trainingsdaten offenzulegen:
- CLEAR-Gesetz: Vor der Veröffentlichung ihrer Produkte müssen AI-Unternehmen eine Liste aller urheberrechtlich geschützten Werke in ihren Trainingsdaten bei der Urheberbehörde einreichen; die Behörde stellt diese Daten dann öffentlich zur Verfügung.
- TRAIN-Gesetz: Rechteinhaber können Anträge stellen, um zu überprüfen, ob ihre Werke für das AI-Training verwendet wurden.
Diese Gesetze legen nicht direkt fest, ob das AI-Training eine Urheberrechtsverletzung dar, sondern geben Rechteinhabern das Recht, Beweise zu sammeln. In Zukunft werden Rechteinhaber leichter herausfinden können, wer ihre Werke verwendet hat – sie können entweder Klage erheben oder Lizenzgebühren mit den AI-Unternehmen verhandeln. Für AI-Unternehmen wird es schwieriger werden, weiterhin gestohlene Daten zu verwenden.
5. Der Fall ist abgeschlossen – doch der „Krieg um das AI-Urheberrecht“ hat gerade erst begonnen
Diese Vereinbarung stellt lediglich einen ersten Schritt für Anthropic dar; das Problem des Urheberrechts beim AI-Training ist noch lange nicht gelöst:
- Die Aussage des Richters zu „angemessener Nutzung“ ist rechtlich nicht bindend; in Zukunft könnten weitere Fälle zu Urheberrechtsverletzungen führen.
- Die Transparenzgesetze des Kongresses werden AI-Unternehmen mit weiteren Klagen konfrontieren.
- Die Gebühr von 3.000 US-Dollar pro Werk ist nicht der Standard; in Zukunft könnten höhere Entschädigungen oder Lizenzgebühren anfallen.
Für die großen AI-Unternehmen stellt sich die eigentliche Herausforderung dar: Werden die Trainingsdaten künftig vollständig offengelegt? Wie hoch würden die Kosten, wenn für jedes einzelne Werk eine Lizenz erforderlich wäre?
Zusammenfassend ist diese Vereinbarung nur ein kleiner Vorfall – der Wettstreit um das AI-Urheberrecht hat gerade erst begonnen.
Zusammenfassung in einem Satz: Anthropic hat 1,5 Milliarden US-Dollar gezahlt, um alte Probleme im Zusammenhang mit dem Einsatz gestohlener Daten für das AI-Training zu lösen. Ob und wie für das AI-Training Lizenzgebühren erhoben werden sollen, hängt jedoch von zukünftigen Gerichtsentscheidungen und Gesetzen ab – der Kampf um das AI-Urheberrecht ist noch lange nicht vorbei.