Zgłoś błąd
X
Zanim wyślesz zgłoszenie, upewnij się że przyczyną problemów nie jest dodatek blokujący reklamy.
Błędy w spisie treści artykułu zgłaszaj jako "błąd w TREŚCI".
Typ zgłoszenia
Treść zgłoszenia
Twój email (opcjonalnie)
Nie wypełniaj tego pola
Załóż konto
EnglishDeutschукраїнськийFrançaisEspañol中国

Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji

Maciej Lewczuk | 18-08-2026 13:30 |

Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencjiSprzedawca rzadkich książek dostał zamówienie na tysiąc tytułów złożone przez platformę Biblio. Anonimowy kupujący, duża skala i przypadkowy dobór pozycji wzbudziły podejrzenia antykwariuszy, którzy od miesięcy obserwują podobne transakcje. Podejrzewają, że stoją za tym firmy AI szukające danych treningowych. Dziennikarze postanowili to sprawdzić i umieścili w jednej z książek lokalizator Apple AirTag. Trop doprowadził ich do magazynu Amazona w Las Vegas.

Śledztwo z ukrytym lokalizatorem pokazuje, że Amazon masowo skupuje rzadkie książki, usuwa ich grzbiety i skanuje strony do treningu własnych modeli AI, fizycznie niszcząc oryginały w tym procesie.

Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [1]

eDziennik w mObywatelu. MEN szykuje pilotaż na rok szkolny 2026/2027, koszt sięgnie 216 mln zł

Wspomniany lokalizator AirTag wędrował z Kalifornii przez Wisconsin i Kolorado, aż zatrzymał się w kompleksie Amazona oznaczonym jako LAS8, w północno-wschodniej części Las Vegas. Przy wejściu do wydzielonej strefy o nazwie VGT3 wisi logo trudne do przeoczenia, gdyż jest to tyranozaur trzymający w pazurach otwartą książkę. Pracownicy magazynu opisywali na forach dla zatrudnionych w Amazonie standardowe działania, w których odbierają ogromne partie drukowanych książek, obcinają ich grzbiety, aby przyspieszyć skanowanie stron, a fizyczne egzemplarze trafiają później do kosza.

Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [2]

Google Play Age Signals API wchodzi do globalnego użytku. Brazylia już testuje, Australia i Kanada dołączają w sierpniu

Amazon potwierdził 404 Media, że kupuje książki legalnymi kanałami handlowymi, aby rozwijać produkty i usługi dla klientów. Firma nie ujawniła jednak, który konkretnie model lub system korzysta z pozyskiwanych w ten sposób danych. Historia przypomina sprawę Anthropic, gdzie ujawniony w pozwie autorów program Project Panama opierał się na podobnym mechanizmie cięcia grzbietów i skanowania milionów tomów. Sędzia William Alsup uznał, że skanowanie legalnie kupionych egzemplarzy na potrzeby trenowania modeli może mieć charakter transformacyjny i mieścić się w ramach dozwolonego użytku. Osobno ukarał jednak firmę za utworzenie cyfrowej biblioteki z książek pozyskanych z pirackich źródeł. W lipcu sąd zatwierdził ugodę o wartości 1,5 miliarda dolarów dotyczącą około 500 tysięcy książek.

Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [3]

Koniec z instalowaniem apki do każdej myszki. Ta strona chce to załatwić jedną kartą przeglądarki

Papier wraca do gry, bo zasób wysokiej jakości tekstów dostępnych w internecie staje się coraz większym ograniczeniem dla rozwoju modeli AI. Trenowanie na treściach wygenerowanych przez inne modele może z kolei prowadzić do zjawiska określanego jako model collapse, czyli stopniowej degradacji jakości, gdy system uczy się na danych zawierających powielone błędy wcześniejszych modeli. Książki wydane przed masowym rozpowszechnieniem generatywnej AI mogą dostarczyć dużych zbiorów tekstu powstałego niezależnie od modeli językowych. Firma ISBNdb, znana przede wszystkim z baz metadanych wydawniczych, miała również oferować usługi związane z masowym pozyskiwaniem książek według numerów ISBN. Jeśli informacje te się potwierdzą, pokazuje to skalę zainteresowania fizycznymi egzemplarzami jako źródłem danych treningowych dla sztucznej inteligencji.

Źródło: 404 Media (w tym ilustracje), Ars Technica, Forbes, Pexels (ilustracje)
Bądź na bieżąco - obserwuj PurePC.pl na Google News
Zgłoś błąd
Liczba komentarzy: 68

Komentarze:

x Wydawca serwisu PurePC.pl informuje, że na swoich stronach www stosuje pliki cookies (tzw. ciasteczka). Kliknij zgadzam się, aby ta informacja nie pojawiała się więcej. Kliknij polityka cookies, aby dowiedzieć się więcej, w tym jak zarządzać plikami cookies za pośrednictwem swojej przeglądarki.