История
август 20, 2026

Гонка Amazon за данными для ИИ ставит редкие книги под нож

Расследование с использованием трекеров усилило внимание к закупкам книг Amazon для обучения ИИ: сообщается, что редкие тома разбирают и сканируют на объекте в Лас‑Вегасе. В Amazon заявляют, что покупают книги через коммерческие каналы, чтобы улучшать свои продукты.

Amazon сделал себе имя на продаже книг. Теперь же цепочка редких томов, которые, по сообщениям, в итоге оказываются на одном из его складов, породила мрачное предположение: невосполнимые печатные издания потребляются, чтобы кормить искусственный интеллект.

Тревога усилилась после того, как 404 Media поместило трекер в отправление с редкими книгами. Устройство в конечном счёте привело к объекту Amazon VGT3 в Лас‑Вегасе, складу, обозначенному символом динозавра с книгой.

Работники этого объекта рассказали изданию, что предприятие получает огромные партии печатных книг, снимает с них переплёты и на высокой скорости сканирует. «Печатная книга уничтожается в этом процессе». Этот рассказ следует за более ранними сообщениями о том, что компании, работающие с ИИ, скупают подержанные книги оптом для обучающих данных.

Логика, по-видимому, предельно проста: крупным языковым моделям требуются колоссальные объёмы текста, в то время как материалы, свободно доступные онлайн, всё больше истощаются, оспариваются или загрязняются текстами, созданными ИИ. Редкие и давно не издающиеся книги могут предоставить тексты, которые трудно найти в цифровом виде — и, что принципиально важно, предшествуют нынешней волне генеративного ИИ.

Amazon не стал комментировать сообщения об уничтожении книг в предоставленных материалах. Но компания заявила 404 Media, что она «покупает книги через коммерческие каналы, чтобы улучшать продукты и сервисы, которыми пользуются клиенты».

Этот ответ точно отражает раскол. Для Amazon книги — это коммерчески приобретаемое сырьё для улучшения продуктов. Для критиков такой практики эксперимент с трекером указывает на однонаправленное превращение ограниченного физического культурного наследия в машиночитаемые данные: переплёты разрезают, страницы сканируют, а издания, которые может быть невозможно заменить, сводят к макулатуре.