Коротко: да, AI-компании действительно скупают и уничтожают книги миллионами экземпляров: срезают корешки гидравлическим резаком, сканируют и выбрасывают оригиналы - это подтверждено судебными документами, а не только слухами. Но вирусные пересказы путают главное: $1,5 млрд Anthropic заплатила не за уничтожение книг, а за пиратские копии. Уничтожать законно купленные книги суд США разрешил. Разбираем по судебным документам, что подтверждено и что это значит для бизнеса.
В 1953 году Рэй Брэдбери написал «451° по Фаренгейту» - роман, где книги уничтожают промышленно, а занимаются этим пожарные. Он ошибся только в деталях: через 70 лет книги действительно уничтожают конвейером - только вместо огня гидравлический резак, и цензура тут ни при чём: всё ради данных. У Брэдбери книги жгли, чтобы люди меньше думали. Сейчас их режут, чтобы машины думали лучше.
Что на самом деле подтверждено документами?
В основе истории лежат более 4 000 страниц судебных документов по иску авторов к Anthropic (дело Bartz v. Anthropic), которые разобрала The Washington Post в январе 2026 года. Из них стало известно о внутреннем проекте Anthropic с кодовым названием Project Panama, запущенном в начале 2024 года.
Схема выглядела так: компания потратила десятки миллионов долларов на скупку миллионов печатных книг, у книг срезали корешки гидравлическим резаком, страницы прогоняли через промышленные сканеры, а оригиналы после оцифровки уничтожали. Цитата из внутреннего планировочного документа, всплывшего в суде: «Project Panama - это наша попытка деструктивно отсканировать все книги мира. Мы не хотим, чтобы об этом стало известно».
Как история дошла до вирусной волны - по датам:
В июле 2026 сюжет разогнался по второму кругу: 25 июля вышел материал Futurism, следом - расследование 404 Media о том, как устроен рынок оптовой скупки книг сейчас, и волна пересказов от PC Gamer до Lenta.ru. Именно в пересказах история начала обрастать неточностями - о них ниже.
За что Anthropic заплатила $1,5 млрд на самом деле?
За пиратство. Резак и сканирование тут ни при чём - и это ключевой факт, который теряется почти во всех вирусных пересказах, включая русскоязычные. У Anthropic было два способа набрать книжный корпус для обучения, и шли они в обратном порядке: сначала пиратство, потом закупка. В 2021 году, ещё до Project Panama, сооснователь компании Бен Манн лично скачал миллионы книг из теневых библиотек LibGen и Books3. Это зафиксировано в решении судьи. Там же и мотивация: у компании были легальные пути получить те же тексты, но она выбрала пиратство, чтобы избежать того, что глава Anthropic Дарио Амодей назвал «юридической и деловой волокитой» (формулировка из судебного решения, июнь 2025). Скупка и сканирование бумажных книг начались позже - как легальная замена пиратскому корпусу.
Судья Уильям Алсуп (федеральный суд Северного округа Калифорнии) в июне 2025 года развёл эти два способа по разным углам:
| Способ получения книг | Вердикт суда |
|---|---|
| Купить бумажную книгу, срезать корешок, отсканировать, уничтожить оригинал | Законно: добросовестное использование (fair use). Суд назвал его «в высшей степени трансформативным» - из книги сделали принципиально новый продукт |
| Скачать книги из пиратских библиотек | Незаконно: добросовестное использование пиратство не покрывает |
За пиратскую часть Anthropic и заплатила: урегулирование на $1,5 млрд (то есть стороны договорились о выплате сами, не дожидаясь приговора) - крупнейшее в истории авторского права США. По условиям - около $3 000 за произведение (по арифметике это порядка 500 тысяч книг) плюс обязательство уничтожить сами наборы скачанных пиратских текстов. Предварительно сделку одобрили 25 сентября 2025 года (обзор Kluwer Copyright Blog), финально - в июле 2026-го (TechTimes, 21.07.2026).
Формула «суд заставил заплатить $1,5 млрд за уничтожение книг» - неправда дважды. Во-первых, платили за пиратские скачивания, а не за работу с купленными книгами. Во-вторых, уничтожение законно купленных книг суд как раз разрешил. Если пересказ склеивает эти два факта в один - перед вами хайп, а не новость.
Для рынка это прецедент с двойным дном (прецедент - судебное решение, на которое дальше будут ссылаться в похожих спорах): пиратить данные дорого, а вот покупать физические носители и «переваривать» их в данные - легально. Что и запустило следующую волну.
Кто и как скупает книги оптом?
Anthropic в этой истории просто попалась первой - из-за суда. The Washington Post прямо пишет, что сюжет показывает, на что готовы ради данных и другие гиганты, включая Google и OpenAI, а Meta параллельно судится с авторами за использование пиратских цифровых книг (об этом упоминает и Futurism). Публичных признаний в «деструктивном сканировании» от других компаний нет, но спрос на бумагу виден по рынку: письма с одинаковыми оптовыми запросами букинисты получают от разных, никому не известных компаний-посредников.
Расследование 404 Media (июль 2026) показало инфраструктуру, которая выросла вокруг этой схемы. Центральный игрок - ISBNdb, сервис, называющий себя крупнейшей в мире базой данных книг. Он предлагает AI-компаниям оптовый закуп от 1 000 до 1 000 000 книг за один заказ - у библиотек, ритейлеров, с распродаж имущества - и обещает покупателям конфиденциальность.
Насколько сознательно это делается, видно по формулировкам самого сервиса из материалов 404 Media: клиентов предупреждают, что «проблема с имиджем реальна», потому что заголовок «AI-компания уничтожила два миллиона книг» сочувствия не вызывает.
Букинисты подтверждают всплеск со своей стороны прилавка:
- Один продавец рассказал 404 Media, что с апреля его продажи выросли с примерно 20 книг в неделю до сотен. Заказы тематически бессвязные, цена покупателей не волнует - главный признак, что книги идут не читателям.
- Голландский букинист Питер де Врис из Харлема получил от сингапурской компании 2077AI заказ на 3 001 книгу и сначала принял письмо за спам или фишинг (NL Times, июнь 2026; Fortune, 31.07.2026). Похожие письма, по сообщениям местных медиа, получали букинисты в Швейцарии, Испании и Германии.
- Продавцы отмечают и обратную сторону: оптовики вычищают неликвид, но вместе с ним «в макулатуру уходят и редкие книги» (404 Media).
Важная оговорка: всплеск продаж пока подтверждён только рассказами отдельных букинистов. Отраслевой статистики - данных Nielsen BookScan или аналогов, которые показали бы аномалию по рынку в целом, - на начало августа 2026 года нет. Пока «массовая скупка по всему миру» держится на нескольких частных историях. Измеренного тренда нет.
Зачем AI-компаниям бумажные книги, если есть интернет?
Потому что интернет испорчен, а бумага - нет. Текст, изданный до примерно 2022 года, гарантированно написан человеком: ChatGPT ещё не существовал, и AI-контент не мог туда просочиться. Всё, что опубликовано позже, под подозрением.
Для обучения моделей это критично из-за эффекта, который называют model collapse - вырождение модели: если нейросеть учится на текстах, написанных другими нейросетями, ошибки и шаблоны накапливаются с каждым поколением, как при близкородственном скрещивании. Поэтому чистые человеческие тексты - дефицитный ресурс, и его ценность растёт. ISBNdb в материалах 404 Media прямо продаёт книги до 2022 года как «структурно чистые от современного отравления».
Остаётся вопрос: зачем уничтожать? Недеструктивное сканирование существует - так оцифровывают архивы библиотеки и музеи. Но книгу с целым переплётом нужно аккуратно листать, а стопку срезанных страниц промышленный сканер протягивает автоматически. Срезать корешок быстрее и дешевле, а купленный экземпляр - собственность покупателя: суд подтвердил, что делать с ним копию для обучения законно. Экономика победила сентименты.
Что это значит для бизнеса?
Три вещи: проверенно человеческие данные стали дефицитным и дорогим активом, происхождение контента превращается в конкурентное преимущество, а правовая рамка работы с данными для обучения моделей прояснилась. Мы в лаборатории ежедневно работаем на моделях Claude - той самой Anthropic из этой истории, - поэтому для нас это в первую очередь сигнал: экономика данных меняется, и вот куда.
Первый: человеческие данные официально стали дефицитом. Когда компании тратят десятки миллионов долларов на бумагу ради «чистого» текста, это ценник на доверенные данные, выставленный рынком. У любого бизнеса такой актив уже есть: переписка с клиентами, записи звонков, отчёты, отзывы, база знаний - всё это гарантированно человеческий материал о вашей нише, которого нет ни у конкурентов, ни у AI-компаний. Как превратить его в рабочий инструмент - разбирали в статье как использовать AI в Google Ads.
Второй: происхождение контента становится валютой. Раз тексты после 2022 года по умолчанию под подозрением, выигрывает контент с доказуемым происхождением: именованный автор с реальным опытом, цифры со ссылками на источник, факты, которые можно проверить. Это ровно те сигналы, по которым и поисковики, и нейросети отбирают, кого цитировать в ответах. Писать «как все» теперь себе дороже: такой текст неотличим от машинного шума.
Третий: правовая рамка определилась - и это снижает риски внедрения. Решение по делу Bartz v. Anthropic задало границу: законно купленное - можно трансформировать, пиратское - оплачивается по $3 000 за штуку. Для бизнеса, который строит свои AI-инструменты на собственных или лицензированных данных, это хорошая новость: правила стали понятнее. Оговорка: прецедент американский и касается авторского права. Для Казахстана рамку задаёт свой закон - «О персональных данных и их защите» № 94-V. Хотите обучать модель на переписке с клиентами или записях звонков? Сначала два условия: согласие людей на обработку их данных и хранение базы на территории РК - таково требование закона о локализации. Тексты без персональных данных - свои регламенты, инструкции, обезличенные отчёты - в этом смысле самый безопасный материал для старта.
Хотите понять, какие данные вашего бизнеса стоит превратить в AI-актив?
Записаться на консультациюЧем закончится эта история?
Скорее всего, ничем драматичным для книг и многим - для рынка данных. Книги в массе своей существуют в тысячах экземпляров, и уничтожение части тиражей их не сотрёт: тревога букинистов касается редких изданий, попадающих в оптовые заказы случайно. Показательно, что сама Anthropic, по данным The Washington Post, потратила на Project Panama десятки миллионов долларов за год - и это только одна компания; письма букинистам в Нидерландах, Швейцарии, Испании и Германии показывают, что скупщиков на рынке уже несколько.
А вот рынок «чистых» данных историю запомнит: цена человеческого текста теперь измерена в десятках миллионов долларов на скупку и в $1,5 млрд выплат за попытку взять его бесплатно. Чем дальше, тем жёстче делится контент на два сорта - с доказуемым человеческим происхождением и весь остальной. Следующий передел уже намечается вокруг архивов газет, писем и рукописей: это последние крупные массивы гарантированно человеческого текста, которые ещё не оцифрованы.
Короткая версия этой истории скоро появится в нашем TikTok.
Частые вопросы
Данные актуальны на 2 августа 2026. Источники: The Washington Post от 27.01.2026 (разбор судебных документов Project Panama), материалы дела Bartz v. Anthropic и решение судьи Уильяма Алсупа от июня 2025 (текст решения и условия урегулирования - по публикациям Authors Guild и юридических обзоров), Futurism от 25.07.2026, расследование 404 Media (июль 2026), NL Times от 25.06.2026 и Fortune от 31.07.2026 (голландские букинисты), TechTimes от 21.07.2026 (финальное одобрение урегулирования), Kluwer Copyright Blog (условия сделки).