Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji
Sprzedawca rzadkich książek dostał zamówienie na tysiąc tytułów złożone przez platformę Biblio. Anonimowy kupujący, duża skala i przypadkowy dobór pozycji wzbudziły podejrzenia antykwariuszy, którzy od miesięcy obserwują podobne transakcje. Podejrzewają, że stoją za tym firmy AI szukające danych treningowych. Dziennikarze postanowili to sprawdzić i umieścili w jednej z książek lokalizator Apple AirTag. Trop doprowadził ich do magazynu Amazona w Las Vegas.
Śledztwo z ukrytym lokalizatorem pokazuje, że Amazon masowo skupuje rzadkie książki, usuwa ich grzbiety i skanuje strony do treningu własnych modeli AI, fizycznie niszcząc oryginały w tym procesie.
eDziennik w mObywatelu. MEN szykuje pilotaż na rok szkolny 2026/2027, koszt sięgnie 216 mln zł
Wspomniany lokalizator AirTag wędrował z Kalifornii przez Wisconsin i Kolorado, aż zatrzymał się w kompleksie Amazona oznaczonym jako LAS8, w północno-wschodniej części Las Vegas. Przy wejściu do wydzielonej strefy o nazwie VGT3 wisi logo trudne do przeoczenia, gdyż jest to tyranozaur trzymający w pazurach otwartą książkę. Pracownicy magazynu opisywali na forach dla zatrudnionych w Amazonie standardowe działania, w których odbierają ogromne partie drukowanych książek, obcinają ich grzbiety, aby przyspieszyć skanowanie stron, a fizyczne egzemplarze trafiają później do kosza.
Google Play Age Signals API wchodzi do globalnego użytku. Brazylia już testuje, Australia i Kanada dołączają w sierpniu
Amazon potwierdził 404 Media, że kupuje książki legalnymi kanałami handlowymi, aby rozwijać produkty i usługi dla klientów. Firma nie ujawniła jednak, który konkretnie model lub system korzysta z pozyskiwanych w ten sposób danych. Historia przypomina sprawę Anthropic, gdzie ujawniony w pozwie autorów program Project Panama opierał się na podobnym mechanizmie cięcia grzbietów i skanowania milionów tomów. Sędzia William Alsup uznał, że skanowanie legalnie kupionych egzemplarzy na potrzeby trenowania modeli może mieć charakter transformacyjny i mieścić się w ramach dozwolonego użytku. Osobno ukarał jednak firmę za utworzenie cyfrowej biblioteki z książek pozyskanych z pirackich źródeł. W lipcu sąd zatwierdził ugodę o wartości 1,5 miliarda dolarów dotyczącą około 500 tysięcy książek.
Koniec z instalowaniem apki do każdej myszki. Ta strona chce to załatwić jedną kartą przeglądarki
Papier wraca do gry, bo zasób wysokiej jakości tekstów dostępnych w internecie staje się coraz większym ograniczeniem dla rozwoju modeli AI. Trenowanie na treściach wygenerowanych przez inne modele może z kolei prowadzić do zjawiska określanego jako model collapse, czyli stopniowej degradacji jakości, gdy system uczy się na danych zawierających powielone błędy wcześniejszych modeli. Książki wydane przed masowym rozpowszechnieniem generatywnej AI mogą dostarczyć dużych zbiorów tekstu powstałego niezależnie od modeli językowych. Firma ISBNdb, znana przede wszystkim z baz metadanych wydawniczych, miała również oferować usługi związane z masowym pozyskiwaniem książek według numerów ISBN. Jeśli informacje te się potwierdzą, pokazuje to skalę zainteresowania fizycznymi egzemplarzami jako źródłem danych treningowych dla sztucznej inteligencji.
Powiązane publikacje

Windows 11 dostanie natywny widżet akumulatorów. Pokaże stan naładowania peryferiów na ekranie blokady i w Widgets Board
26
GPT-6 Astra przechodzi całą grę Portal bez ludzkiej pomocy. Wystarczyło 3336 wywołań narzędzi i 571 dolarów w tokenach
28
Od pustego folderu do aplikacji WinUI 3 w około 30 minut. Microsoft pokazuje workflow z AI
26
Modderzy stworzyli DLSS 5 Swapper. Neural Rendering można włączyć także w starszych grach
89







![Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [1]](/image/news/2026/08/18_masowy_skup_i_fizyczna_destrukcja_rzadkich_ksiazek_tak_amazon_zdobywa_dane_treningowe_dla_sztucznej_inteligencji_1.jpg)
![Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [2]](/image/news/2026/08/18_masowy_skup_i_fizyczna_destrukcja_rzadkich_ksiazek_tak_amazon_zdobywa_dane_treningowe_dla_sztucznej_inteligencji_0.jpg)
![Masowy skup i fizyczna destrukcja rzadkich książek. Tak Amazon zdobywa dane treningowe dla sztucznej inteligencji [3]](/image/news/2026/08/18_masowy_skup_i_fizyczna_destrukcja_rzadkich_ksiazek_tak_amazon_zdobywa_dane_treningowe_dla_sztucznej_inteligencji_2.jpg)





