KI-Firmen kaufen und zerstören seltene Bücher fürs Training

The Vanishing Page: AI Firms Scan Then Destroy Rare Book Editions

KI-Firmen kaufen und zerstören seltene Bücher fürs Training

KI-Unternehmen kaufen physische Bücher in Massen, darunter seltene und vergriffene Titel, schneiden die Buchrücken auf, scannen die Seiten und entsorgen die Originale. Ein Bundesrichter entschied, dass diese Digitalisierung als faire Nutzung gilt. Anthropic betrieb das Projekt Panama, bei dem bis zu zwei Millionen Bücher zerstört wurden. Dienstleister wie ISBNdb vermitteln anonyme Bestellungen von bis zu einer Million Bänden. Buchhändler in Europa berichten von ungewöhnlichen Massenkäufen, die seltene Ausgaben aus dem Verkehr ziehen.

„Project Panama ist unser Bestreben, alle Bücher der Welt destruktiv zu scannen.“
  1. quacked

    Die Menschheit ist noch nicht in der Realität der Zeit angekommen; wir sollten die Urheberrechtsgesetze anpassen, sodass alles, was älter als, sagen wir, 10 Jahre ist, kostenlos im Internet gehostet werden kann. Wir sollten riesige Datenbanken mit Musik, Büchern, Filmen usw. haben, die frei getauscht und heruntergeladen werden können, ohne gegen Gesetze zu verstoßen. Vielleicht war der kommerzielle Schutz von Kunst und geistigem Eigentum in der Vergangenheit notwendig, aber mit dem Internet und KI denke ich, dass wir als Spezies darüber hinwegkommen und uns auf die Archivierung und Verbreitung von Informationen konzentrieren sollten, anstatt auf den Schutz von Einkommensströmen.

  2. cowanon77

    Oberflächlich betrachtet scheint es schlecht zu sein, obwohl viele dieser Bücher wahrscheinlich am Ort verrotteten, anstatt gelesen zu werden. Wenn die Unternehmen bereit sind, die digitale Version verfügbar zu machen, könnte dies die Bücher tatsächlich erhalten.

    Beunruhigender finde ich den Fokus auf Daten vor 2022. Das deutet darauf hin, dass die Unternehmen ernsthaft besorgt über den Modellkollaps sind, bei dem zukünftige Modelle schlechter werden, weil sie mit generierten Daten statt mit echten menschlichen Daten gefüttert werden.

    Das ist tatsächlich mein Worst-Case-Szenario für KI: Die Modelle werden gut genug, um ganze Branchen in den nächsten 10 Jahren zu stören, bleiben dann aber auf diesem Niveau eingefroren. Dann setzt eine Modell-Drift ein, weil sich die Welt weiter verändert, die Modelle jedoch nicht, und in ein paar Jahrzehnten machen wir tatsächlich Rückschritte statt Fortschritte, weil es nicht genug qualifizierte Menschen geben wird, um Fortschritte voranzutreiben.

  3. eleventen

    Es gibt eine gute Diskussion im vorherigen Thread von vor 6 Tagen: https://news.ycombinator.com/item?id=49068738

  4. inigyou

    Ja, da wir uns so sehr über ihre Urheberrechtsverletzungen beschwert haben, verletzt es kein Urheberrecht, wenn sie das Original zerstören, also zerstören sie jetzt das Original. Wir haben unsere Forderungen erfüllt bekommen.

  5. NishanStepak

    Als Google seine Bücher scannte, hat es keines der Bücher zerstört. Dies geschah wegen der Idee des "kulturellen Objekts", bei dem das Buch einen Wert als physisches Artefakt hat. Das Erlebnis, ein physisches Buch zu lesen, unterscheidet sich vom Lesen eines elektronischen Textes. Es gibt ein Argument, dass das Lesen eines Buches in seiner ursprünglichen Form besser ist, weil es näher am ursprünglichen Erlebnis ist. Dies kann auch für Schallplatten und Kassetten gesagt werden. Das Erlebnis ist darauf ausgelegt, im ursprünglichen Format zu funktionieren. Ein Buch ist ein gestaltetes Objekt mit kultureller Bedeutung. Der Behälter für die Wörter kann genauso wichtig sein wie die eigentlichen Wörter. Es sollte klarere Unterscheidungen und Richtlinien zwischen Massenmarktproduktion, bei der Gegenstände zerstört werden können und trotzdem noch viele übrig bleiben, und einzigartigen und originellen Inhalten mit begrenzten Kopien geben. Das ist nicht schwer zu tun. Es nicht zu tun, zeigt Nachlässigkeit.

Mehr von diesem Tag

2026-08-02