Close
10 сентября 2026, Четверг
Информационно-познавательный портал. 16+

Цифровой голод: зачем искусственный интеллект скупает старые книги в Канаде

10.09.2026 Разместил: Редакция 36

Канадский рынок подержанной литературы переживает аномальный бум. Букинистические лавки от Ванкувера до Торонто завалены оптовыми заказами на специфическую литературу, и владельцы бизнеса все чаще смотрят на покупателей с подозрением. Об этом сообщает Naked Science.

Фото из открытых источников / © GigaChat

Владелец магазина Sellers & Newel в Торонто Питер Селлерс отмечает, что раньше оптовики были дизайнерами интерьеров, которым нужны были корешки определенного цвета для оформления стен. Теперь же запросы изменились.

«Мне написали в LinkedIn, — делится Селлерс. — Некая компания по инженерии данных искала поставщиков больших объемов старых книг».

Продавец проигнорировал письмо, но вскоре выснилось, что бумагу массово оцифровывают ради обучения нейросетей, а физические носители затем утилизируют.

Схема работает безотказно. По словам Патрика Хемпельманна из BMV Books, за последние полгода у него вымели складские остатки узкоспециализированных изданий малыми тиражами — старые учебники по высшей математике, физике и медицине. Владелец Pulpfiction Books Крис Брейшоу уверен, что за покупками стоят технологические гиганты, использующие сеть подставных фирм-однодневок для сокрытия своих аппетитов.

Аналогичная картина наблюдается в США. Стало известно, что разработчик Anthropic тратил миллионы долларов на закупку бумажных копий. Сотрудники отрывали корешки, сканировали страницы для датасетов, после чего отправляли тома под пресс.

Интерес искусственного интеллекта к пыльным полкам имеет четкую временную границу — 2022 год, дата релиза ChatGPT. Разработчики столкнулись с проблемой так называемого коллапса моделей: если обучать алгоритм на текстах, которые он сам же и сгенерировал, качество языка стремительно падает. Моделям нужна первозданная человеческая речь со всеми ее синтаксическими шероховатостями. Кроме того, покупка физического экземпляра позволяет компаниям обходить претензии правообладателей цифрового контента. Сканируя купленную книгу и уничтожая оригинал, корпорация оставляет у себя единственную цифровую копию, формально не нарушая законов об авторском праве.

По прогнозам аналитиков Gartner, опубликованным в начале 2026 года, мировой спрос на уникальные офлайн-данные для обучения генеративных моделей будет расти минимум на 40% ежегодно. Эксперты полагают, что следующим этапом бума станет охота за частными дневниками, рукописными архивами и региональными альманахами, которые никогда не переводились в цифру.

Вирус для разума: как генеративный ИИ перепрошивает человеческое мышление