News Überführt: Amazon kauft seltene Bücher für KI-Training und zerstört sie

Mal vom Buchaspekt abgesehen.
Wie lange wird es noch dauern bis für KI Training keine größeren neuen Informationsdepots mehr gibt die man plündern kann?
Zumal immer größere Teile der bestehenden digital vorliegenden Quellen bereits durch KI so stark verunreinigt sind das sie sich nicht mehr als frische Quelle zum Training eignen?
Das man jetzt schon aufwändig auf analoges Material losgeht ist doch ein deutliches Zeichen das der Futtertrog bald leer ist!?🤔

Bücher sind in der Hinsicht, um wieder eine Analogie zu verwenden, schon fast sowas wie angegülltes Eisbergwasser.
Bald wird die KI nur noch gesiebtes aus der Kläranlage bekommen...🙄

Was mich eher stött als die Vernichtung von stark redundanten altbeständen ist dieses Konkurrenzdenken gegeneinander und daraus resultierendem mehrfachen Vernichtung derselben Exemplare. Das kostet zudem auch noch Energie und Ressourcen.
Wieso nicht einfach zusammen arbeiten und den gesammten Weltbestand einmal einscannen. Dann bleiben auch Ressourcen frei um seltenere Exemplare aufwändig aber zerstörungsfrei zu scannen. Aber nein...🙄
 
Zuletzt bearbeitet:
  • Gefällt mir
Reaktionen: Weyoun und Alphanerd
MichaG schrieb:
Das kann ich gerne ergänzen, verstehe aber mal wieder nicht den "Aufschrei" hier.
Dein Artikel ist tendenziös (kann ich verstehen, bringt Klicks und dir Milch in den Kühlschrank), aber auch sachlich falsch (kann ich verstehen, bringt mehr Klicks und Kommentare im Forum und dir Milch in den Kühlschrank).
 
  • Gefällt mir
Reaktionen: pseudopseudonym und cubisticanus
Das automatisierte Kopieren und Verarbeiten nicht-freier Werke ist legaler Fair Use, wenn sie für LLM/KI Training verwendet wird?

Aber Urheberrecht bedeutet doch eben gerade, Werke sind inhaltlich geschützt, unabhängig vom Medium auf dem sie Käufern bereit gestellt sind.

Hier wurde so vorgegangen, menschliche Nuztung und automatisierte Nutzung gleichzusetzen. Zum Nachteil der Urheber: In dem Moment wo ein Konzern ein Buch kauft und die KI trainiert, hat alle Welt inhaltlichen Zugriff darauf ohne explizites Einverständnis des Urhebers.
 
  • Gefällt mir
Reaktionen: Weyoun und R4yd3N
samuelclemens schrieb:
Wie lange wird es noch dauern bis für KI Training keine größeren neuen Informationsdepots mehr gibt die man plündern kann?
Dass ist schon lange der Fall, weswegen man zu Aktionen wie hier übergeht, was aber im Gesamten-Kontext der bereits erfassten Daten eher so 0,0X% extra geben wird... Also komplett zu vernachlässigen für die Skalierung der "KI".

"KI" steckt schon lange massiv in den "Diminishing Returns" und dass wird sich auch nicht ändern.
Jedes % mehr an "Leistung" wird massiv viel teurer werden und massiv viel mehr Rechenleistung, Trainings-Daten, Wasser etc. brauchen. Und alles nur dafür, dass am Ende das Ding weiter nicht gut genug für einen Großteil der wirklichen Arbeit ist, da es immer noch nicht versteht was es liest/wiedergibt.


Rein kulturell gesehen, ist dass was die "KI" Anbieter hier machen ein gutes Bild für den Zustand ihres Produktes: sie profitieren massiv vom Wissen aller, entlohnen die Urheber aber kaum bis gar nicht, während sie gleichzeitig die Kultur in allen Bereichen in die sie expandieren zerstören, weil die Manager in den Bereichen natürlich den großen $ darin sehen, die Kultur aus dem Bereich zu entfernen und sie durch Algorithmen zu ersetzen.

Leider klappt dass in der Realität nicht, weil keiner "KI" Käse kaufen möchte. Aber leider hält dass niemanden davon ab "KI" Bücher, Filme/Serien zu erstellen, die dann unterste Kanone sind was Qualität angeht und somit echte Werke in der Masse verschwinden lassen. Heute ein Buch zu Self-Publishen ist noch mal X Nummern schwerer als vor dem "KI" Boom und selbst wenn die großen Anbieter pleite gehen, die Leute die "KI" Bücher machen werden dann halt einfach von ihrer lokalen GPU generierten Müll nehmen...


Wobei dass auch ein gutes hat: bisher haben alle Studien zum Thema Training festgestellt, dass "KI" schlechter wird, wenn sie auf Basis ihrer eigenen Ausgaben trainiert wird. Schon heute dürften diese Daten sehr häufig in die Trainings-Daten einfließen und somit das Produkt langfristig verschlechtern, da die Menge an "KI" Daten deutlich schneller wächst als die von menschlichen Urhebern.
 
  • Gefällt mir
Reaktionen: Weyoun und R4yd3N
MDM schrieb:
Dabei geht es um besseres Klopapier.
Das dürfte in der Mehrzahl der Fälle wohl stimmen, aber ich bin mir sicher, dass im Wust der aufgekauften und eingescannten Bücher auch ein paar Perlen dabei sein dürften. Das gilt nicht zuletzt für Bücher aus dem wissenschaftlichen Bereich. Deshalb ist m.E. auch die Frage der Bewertung der Relevanz dieser Bücher mitentscheidend für eine Einschätzung des Vorgehens von Amazon.
 
  • Gefällt mir
Reaktionen: Weyoun
LencoX2 schrieb:
Das automatisierte Kopieren und Verarbeiten nicht-freier Werke ist legaler Fair Use, wenn sie für LLM/KI Training verwendet wird?

Aber Urheberrecht bedeutet doch eben gerade, Werke sind inhaltlich geschützt, unabhängig vom Medium auf dem sie Käufern bereit gestellt sind.
Seufz. Manchmal wäre es sinnvoll, auch zu wissen, worüber man schreibt. Auch in Deutschland ist es erlaubt, urheberrechtlich geschützte Werke zwecks wiss. Datamining zu verwerten: https://www.gesetze-im-internet.de/urhg/__60d.html

Sicher, bei uns geht's klar um Wissenschaft & kommerzielle Varianten wie in den USA sind ausgeschlossen, aber Urheberrecht heißt halt nirgendwo: totale Rechte für den Urheber 😉
 
Dann kauft sie doch zuerst? Diese Bücher sollten doch verkauft werden?
 
  • Gefällt mir
Reaktionen: conorqa
Ich bin schockiert und angewidert. Menschen sind schon scheiße.
 
Ist doch egal was der Käufer mit nem Buch macht? Ist doch seine Sache? Wenn ich mir nen Buch kaufe, es durchlese oder es scanne und auf dem PC sichere und danach die Seiten raus reiße und mir den Arsch damit abwische, wen juckts?
 
  • Gefällt mir
Reaktionen: Fliz
Schmarall schrieb:
Wer Bücher absichtlich zerstört (z.B. verbrennt) ist ...
Unter welcher Rubrik subsumierst Du die Wiedereinbringung eines Buches in der Papierrecyclingkreislauf mittels Altpapiertonne?
 
  • Gefällt mir
Reaktionen: cubisticanus und MDM
Gr.mm schrieb:
nochmal: Sie MÜSSEN die bücher nach amerikanischem urheberrecht vernichten, nachdem sie sie gescannt haben. andernfalls machen sie sich der illegalen vervielfältigung schuldig.
das ist nicht die schuld der bösen konzerne, sondern die des rückständigen urheberrechts
Und wie macht das die Situation genau besser? Verstehe deinen Kommentar nicht ganz? Zumal du ja wahllos zitierst.

Irgendeinen Unterstützer dieser Aktion scheint es ja zu geben, egal wer dahintersteckt.
 
@MDM Meist widerruft man ja nur die Lizenz 😂 -- aber du hast völlig Recht, die Diskussion hier ist erstaunlich faktenfrei bei vielen, dafür um so emotionaler.
 
hä, bin ich doof oder was ist nun genau mit seltenen büchern gemeint????????? irgendwie verstehe ich den absatz nicht
 
Klingt nach einer super Synergie.
Sie Bücher die man selbst nicht verkauft bekommt liest man halt selbst und vernichtet sie dann 😄
 
lucdec schrieb:
Ich verstehe die Aufregung nicht? Anscheinend haben diese Lagerleichen jahrelang niemanden interessiert und die würden auch in ein paar Jahren noch da liegen. Dann werden sie einem sinnvollen Zweck zugeführt und trainieren ein KI-Modell und potenziell können so Millionen Menschen mehr oder weniger direkt von dem „vergessenen Wissen“ profitieren, dann ist es auch wieder nicht recht.
ich verstehe den inhalt dieses artikels auch nicht genau bzw. wenn "seltene bücher" erwähnt wird. so wie ich es verstehe sind es einfach bücher die man kaufen kann, also nichts spezielles. dann ist es wirklich ein geschrei für nix xD
 
Zurück
Oben