Im Quellenvergleich

Amazon zerstört Bücher für KI

6 Quellen · 6 Meldungen · Stand 19.08.2026

Alle Inhalte werden von KI erstellt. Dieser Überblick fasst zusammen, worin sich mehrere Quellen einig sind und worin sie sich unterscheiden — die Bewertung bleibt dir überlassen.

Im Quellenvergleich

Worin die Quellen übereinstimmen

Eine Recherche verfolgte eine Lieferung seltener Bücher per AirTag bis zu einem Amazon-Lager in Las Vegas. Dort schneiden Mitarbeiter die Buchrücken ab und scannen die Seiten, wodurch das gedruckte Buch zerstört wird. Amazon bestätigt, Bücher zu kaufen, um Produkte zu verbessern, äußert sich aber nicht zu Details. Gedruckte Bücher sind für KI-Training wertvoll, weil ihr Text oft nicht im Internet steht und bei Druck vor 2022 garantiert kein KI-generierter Inhalt ist. Buchhändler vermuten, dass KI-Firmen systematisch ISBN-Listen abarbeiten. Ähnlich ging bereits Anthropic vor: Deren Projekt „Panama“ schnitt ebenfalls Buchrücken ab; ein Gericht urteilte, das sei als Fair Use erlaubt, weil das Original zerstört wird. Die Quellen berichten weitgehend übereinstimmend. Amazon nutzt die gescannten Daten eigenen Angaben zufolge für seine Nova-Modelle. Das Team im Lager trägt ein Logo mit einem Tyrannosaurus rex, der ein Buch verschlingt. Ein Buchhändler versteckte den AirTag in einer Lieferung von rund 1.000 Büchern; die Sendung reiste von Kalifornien über Wisconsin und Colorado nach Las Vegas. Amazon kauft die Bücher über kommerzielle Kanäle. Die Einheit im Lager heißt VGT3. Digitalisiert werden nur Bücher mit ISBN. Ein US-Richter entschied, dass das Scannen und Zerstören gekaufter Bücher als faire Nutzung gelten könne, da keine zusätzlichen Kopien entstehen. Amazon entwickelte die Praxis, um zu verhindern, dass seine Modelle durch KI-generierten Text „kontaminiert“ werden – ein Phänomen, das als „Modellkollaps“ bekannt ist und die Antwortqualität verschlechtert. Ein US-Gericht entschied im Juni 2025, dass das Training auf urheberrechtlich geschützten Werken als Fair Use gilt; für über sieben Millionen aus Piratenquellen stammende Bücher lehnte das Gericht die Fair-Use-Verteidigung ab. Anthropic stimmte einer Einigung über 1,5 Milliarden Dollar mit Autoren zu.

Aktualisierungen
17.08.2026
17:08Amazon nutzt die gescannten Daten eigenen Angaben zufolge für seine Nova-Modelle.
19:06Das Team im Lager trägt ein Logo mit einem Tyrannosaurus rex, der ein Buch verschlingt.
Ein Buchhändler versteckte den AirTag in einer Lieferung von rund 1.000 Büchern; die Sendung reiste von Kalifornien über Wisconsin und Colorado nach Las Vegas.
20:05Amazon kauft die Bücher über kommerzielle Kanäle.
Die Einheit im Lager heißt VGT3.
Digitalisiert werden nur Bücher mit ISBN.
Ein US-Richter entschied, dass das Scannen und Zerstören gekaufter Bücher als faire Nutzung gelten könne, da keine zusätzlichen Kopien entstehen.
19.08.2026
11:08Amazon entwickelte die Praxis, um zu verhindern, dass seine Modelle durch KI-generierten Text „kontaminiert“ werden – ein Phänomen, das als „Modellkollaps“ bekannt ist und die Antwortqualität verschlechtert.
Ein US-Gericht entschied im Juni 2025, dass das Training auf urheberrechtlich geschützten Werken als Fair Use gilt; für über sieben Millionen aus Piratenquellen stammende Bücher lehnte das Gericht die Fair-Use-Verteidigung ab.
Anthropic stimmte einer Einigung über 1,5 Milliarden Dollar mit Autoren zu.
Worin sie sich unterscheidenZweck der gescannten Daten·Team-Logo im Lager·Bewertung der Zerstörung+3 weitere
Zweck der gescannten DatenAmazon erklärte, man kaufe Bücher über kommerzielle Wege, um Produkte und Dienste für Kunden zu verbessern.
  • Amazon erwähnte das KI-Training in seiner Stellungnahme nicht.1
Team-Logo im LagerDas Logo an der Tür zeigte einen Tyrannosaurus Rex, der ein Buch verschlingt.
  • Das Logo zeigt einen Tyrannosaurus rex mit einem Buch.2
Bewertung der Zerstörung
  • Kritiker befürchten, dass die Zerstörung physischer Exemplare manche Bücher unersetzlich macht.3
  • Ein Buchhändler betont, die Firmen ignorierten den historischen und sentimentalen Wert der Bücher.4
Folge des Trainings mit KI-generiertem TextTrainieren Modelle mit KI-generiertem Text, droht der sogenannte „Model Collapse“ – die Qualität der Ausgaben verschlechtert sich.
  • Amazon will damit verhindern, dass seine Modelle durch KI-Text „kontaminiert“ werden.5
Konkurrenz-Verhalten
  • Konkurrenten wie Anthropic und xAI haben öffentlich erklärt, sie trainierten nicht mit seltenen oder antiken Büchern.1
  • Anthropic scannte im Projekt Panama Millionen Bücher zerstörend.3
  • Meta nutzte Bücher für seine Llama-Modelle und sah sich Klagen wegen angeblich gestohlener Bücher aus LibGen gegenüber.3
  • OpenAI unterstützte ein Projekt, das fast eine Million digitalisierte gemeinfreie Bücher veröffentlichte.3
  • Google digitalisierte seit den 2000er-Jahren Millionen Bücher.3
Methode des Scannens
  • Zerstörendes Scannen ist schneller, aber nicht die einzige Methode.3
  • Das Internet Archive scannt nicht-destruktiv.3

Quellen (6)

Vollständige Übersicht mit allen Meldungen öffnen →