Цифровой апокалипсис: как ИИ-компании уничтожают миллионы книг | SforNews

  • 30 Июл, 2026
    | Salome K

Цифровой апокалипсис: как ИИ-компании уничтожают миллионы книг, чтобы «накормить» свои модели

Антропоцен знаний: человечество впервые в истории систематически уничтожает собственное культурное наследие ради обучения машин, которые завтра будут решать, какая информация дойдёт до наших глаз

Пролог: тишина в промышленных ангарах

Где-то в промышленных ангарах, без шума и без свидетелей, происходит то, что историки будущего, возможно, назовут одним из самых мрачных эпизодов цифровой эпохи. Машина отрезает у книги корешок. Проглатывает страницы одну за другой, сканируя их с индустриальной скоростью. А то, что остаётся от книги, отправляется в шредер. Бумажные носители исчезают навсегда [6][18].

Уникальные экземпляры, которые существовали сто лет, теперь будут измельчены. Их содержание — под замком, внутри машин искусственного интеллекта, которые завтра решат, какая информация дойдёт до ваших глаз… а какая нет [10].

Это не фантастика. Это реальность 2024–2026 годов [1][11].

Часть 1. «Панама»: как Anthropic решила уничтожить все книги мира

В начале 2024 года руководство Anthropic — компании, создавшей популярного AI-ассистента Claude, — запустило амбициозный проект. Внутренние документы, позже рассекреченные судом, называли его «Проект Панама» (Project Panama). Формулировка была пугающе прямой: «Project Panama is our effort to destructively scan all the books in theworld» — «наша попытка деструктивно отсканировать все книги в мире» [1][6][18].

Следующая строка в том же документе была ещё более красноречива: «We don’t want it tobe known that we are working on this» — «Мы не хотим, чтобы было известно, что мы работаем над этим» [6][18].

Компания осознавала, как это выглядит. И всё равно пошла на это.

Чтобы реализовать проект, Anthropic наняла Тома Терви (Tom Turvey) — бывшего руководителя партнёрских отношений Google Books, человека, который двумя десятилетиями ранее стоял у истоков знаменитого, но юридически оспариваемого проекта по оцифровке книг Google [6][18]. Задача Терви была сформулирована амбициозно и пугающе: получить «all the books in the world» — «все книги в мире» [6].

Технология была отработана до совершенства. Anthropic закупила миллионы подержанных книг у книжных ритейлеров, включая Better World Books [18]. Используя гидравлические резаки, компания «аккуратно отрезала» корешки. Затем страницы прогонялись через высокоскоростные промышленные сканеры. И наконец — остовы книг отправлялись в переработку [1][5][10].

Всё законно. И в этом — главная трагедия.

Часть 2. Анатомия юридической лазейки: почему уничтожение книг — это «законно»

В июне 2025 года федеральный судья Уильям Алсуп вынес решение, которое изменило правила игры. Он постановил, что деструктивное сканирование книг Anthropic подпадает под доктрину первой продажи (first-sale doctrine) и является добросовестным использованием (fair use) [0][1][7][8].

Логика судьи была безупречна с формально-юридической точки зрения и ужасна с точки зрения здравого смысла:

«Anthropic “purchased its print copies fair and square,” … “Here, every purchased print copy was copied in order to save storage space and to enable searchability as a digital copy. The print original was destroyed. One replaced the other”» [0][1][7].

Парадокс: именно уничтожение книги сделало её сканирование законным. Если бы Anthropic сохранила бумажный оригинал, у неё было бы две копии — и это могло быть нарушением. Уничтожив оригинал, она оставила себе только одну копию — цифровую [0][1].

Судья также признал использование «трансформативным» — компания не создавала дополнительные физические копии и не распространяла их [0][7]. С формальной точки зрения это был не «пиратский захват», а «консервация пространства» через конвертацию формата.

Но вот что важно: этот вердикт касался только тех книг, которые Anthropic легально приобрела. Что касается пиратских копий, скачанных из «теневых библиотек», — здесь суд встал на сторону авторов [7].

Часть 3. Путь воровства: как Anthropic начала с пиратства

Прежде чем Anthropic начала платить за книги, она их просто… воровала.

В июне 2021 года соучредитель Anthropic Бен Манн за 11 дней скачал миллионы книг из LibGen — онлайн-«теневой библиотеки», где бесплатно выкладываются пиратские тексты. Среди скачанного была библиотека Books3 — 196 640 пиратских книг. Затем последовали ещё 5 миллионов из Library Genesis и 2 миллиона из Pirate Library Mirror [1][3][4][7].

Внутренняя переписка Meta, вскрытая в других судебных процессах, показывает, что это была не просто «ошибка» Anthropic, а индустриальная практика [7]. В одном из писем сотрудники Meta писали, что доступ к пиратским книгам «essential» — «критически важен» для конкурентоспособности [7].

Итог: Anthropic использовала пиратские копии для обучения своих ранних моделей. А когда пиратство стало слишком рискованным — перешла к легальной покупке и уничтожению физических книг [0][1].

Часть 4. Цена вопроса: $1,5 млрд и $3000 за книгу

В августе 2025 года Anthropic согласилась выплатить $1,5 миллиарда в рамках урегулирования коллективного иска авторов. Это крупнейшее известное урегулирование в сфере авторского права в истории [2][3][4][13][14][15].

Сумма распределялась между авторами и издателями примерно 500 000 произведений. Каждый автор мог получить около $3000 за книгу. Около 91% из более чем 482 000 книг, затронутых решением, были заявлены авторами или издателями [3][4][14].

С точки зрения финансов Anthropic, это были копейки. Но самое важное: урегулирование касалось только пиратских копий. Деструктивное сканирование легально приобретённых книг осталось законным [0][7][14].

Часть 5. Почему старые книги? Гонка за «чистыми» данными

Почему ИИ-компании охотятся именно на старые книги — изданные до 2022 года?

Ответ прост и пугающинтернет «отравлен» контентом, сгенерированным самим ИИ.

Исследование Nature 2024 года назвало это явление «коллапсом модели» (model collapse). Если модель обучается на текстах, созданных другой моделью, она деградирует: теряет разнообразие, креативность, точность. Качество падает. Ответы становятся всё более шаблонными.

Прогнозы говорят, что высококачественные текстовые данные для обучения ИИ могут быть исчерпаны уже к 2026 году. Интернет, несмотря на свой гигантский объём, заполнен шумом, повторами и низкокачественным контентом [1].

Книги, изданные до 2022 года, — это «чистые» данные. Они написаны людьми. В них нет AI-«слопа» (низкокачественного машинного контента). Именно поэтому они стали самым горячим товаром на рынке данных [0][1][5].

Компания ISBNdb, предлагающая услуги по массовой закупке книг для AI-лабораторий, прямо заявляет: «The world’s best AI training data is sitting on a shelf» — «Лучшие в мире данные для обучения ИИ лежат на полке». На своём сайте они также признаютрепутационный риск«AI company destroys two million books is not a headline that generates sympathy» [5].

Часть 6. Новый рынок: книги как «сырьё»

Открывшаяся юридическая лазейка породила новый рынок. ISBNdb и другие посредники теперь предлагают AI-компаниям услуги по массовой закупке книг — от 1000 до 1 миллиона экземпляров за один заказ [5][17].

Покупатели действуют анонимно, через посредников, подписывая соглашения о неразглашении [1][6][18]. Книготорговцы по всему миру сообщают о резком росте объёмов закупок: с примерно 20 книг в неделю до нескольких сотен [18]. Особенно ценятся редкие и вышедшие из печати издания — те, что уже не существуют в цифровом виде и больше никогда не будут переизданы [10][18].

Лондонские букинисты рассказывают о подозрительных заказах от анонимных покупателей, которые просят дополнительные фотографии книг перед покупкой, но отказываются называть свои имена [18]. Похожие сообщения приходят из Нидерландов и других европейских стран [18].

Книга перестала быть носителем знания. Она стала сырьём [5][10].

Часть 7. «Законно, но не хорошо»: этическая пропасть

Внутренние документы Anthropic показывают, что компания осознавала моральную проблематичность своих действий. Один из соучредителей объяснял, что книги научат ИИ «how to write well» вместо того, чтобы имитировать «low quality internet speak» [6][18].

Но это не оправдывает уничтожение уникальных экземпляров.

«Уникальные экземпляры, которые существовали сто лет, теперь будут измельчены. Их содержание — под замком, внутри машин ИИ, которые завтра решат, какая информация дойдёт до ваших глаз… а какая нет» [10].

Книги, уничтоженные Anthropic, не были «макулатурой». Среди них были редкие, вышедшие из печати, существующие в единственном экземпляре издания [10][18]. Их оцифрованные копии теперь хранятся в дата-центрах, доступ к которым контролируется частной компанией [10].

Что произойдёт, если эти дата-центры будут уничтожены? Глобальный блэкаут. ЭМИ-импульс. Кибератака. Знания, накопленные человечеством, — исчезнут навсегда. Оригиналов больше нет [10].

Часть 8. Контр-пример: Илон Маск и SpaceXAI

На фоне этой практики выделяется позиция Илона Маска. В ответ на разоблачения он написал в социальной сети X:

«Я попросил команду SpaceXAI сохранить все редкие книги в библиотеке и сканировать их медленным, неразрушающим способом, а не просто отрезать корешок».

Маск публично осудил практику Anthropic, назвав её неприемлемой. Его подход — неразрушающее сканирование — медленнее и дороже, но позволяет сохранить физические оригиналы.

Пока что это лишь обещание. Но сам факт, что один из лидеров индустрии публично отмежёвывается от этой практики, — важный сигнал.

Часть 9. Архитектурный вывод: что это значит для нас

Первое. Проект «Панама» — не просто «дикий нрав» одной компании. Это архитектурный сдвиг. Монополия на физическое знание заменяется монополией на цифровой доступ к нему [0][1][6].

Второе. Юридическая система, созданная для защиты физических копий, оказалась слепа к цифровой реальности. Доктрина первой продажи, разработанная для регулирования рынка подержанных книг, теперь используется для оправдания их систематического уничтожения [0][1][7].

Третье. Гонка за «чистыми» данными — это гонка за контроль над прошлым. Тот, кто владеет оцифрованными знаниями, получает возможность редактировать их и влиять на наше восприятие истории [1][10].

Четвёртое. «Законно» ≠ «хорошо». То, что суд признал деструктивное сканирование законным, не делает его этически приемлемым. Уничтожение культурного наследия ради обучения машин — это сделка, о которой мы ещё пожалеем [0][10].

Пятое. Мы стоим на пороге мира, где люди потеряют контроль не только над будущим, но и над прошлым. Знания человечества, переработанные в «сырьё» для ИИ, могут быть утеряны навсегда — либо физически (если дата-центры будут уничтожены), либо интеллектуально (если доступ к ним будет монополизирован) [10][18].

Эпилог: точка невозврата

Anthropic заплатила $1,5 миллиарда. Уничтожила миллионы книг. Получила легальное право на это. И продолжает дальше.

Другие компании следуют её примеру. ISBNdb и другие посредники уже продают «услугу по уничтожению книг» другим AI-лабораториям [5][17].

«AI company destroys two million books is not a headline that generates sympathy» — признают они сами [5].

Но это не останавливает процесс.

Вопрос: что произойдёт, когда мы уничтожим последнюю физическую копию последней книги, а дата-центры, где хранятся их цифровые двойники, будут уничтожены? Не останется ничего. Ни оригиналов. Ни копий. Ни знаний.

Проект «Панама» — это не просто скандал. Это предупреждение. О том, что технологии, созданные для служения человечеству, могут обернуться против него. О том, что закон не всегда защищает то, что действительно важно.

И о том, что, возможно, ИИ уже поработил разум своих разработчиков, превратив их в соучастников уничтожения всех знаний, накопленных человечеством [10].

Список источников

[0] Gate News — Anthropic Сканировала миллионы книг, уничтожая ихсудьяпостановил, что это законно (2026)
[1] Ars Technica / Il Giornale — Anthropic destroyed millions of print books to build its AI models (2025)
[2] Reuters / AP News — Anthropic $1.5 billion settlement of copyright lawsuit (2025–2026)
[3] Ropes & Gray / Lexology — Anthropic’s Landmark Copyright Settlement (2025)
[4] Ropes & Gray / Publishers Weekly — Anthropic’s use of pirated books from LibGen (2025)
[5] 404 Media / Futurism — AI companies destroying rare books in bulk via ISBNdb (2026)
[6] The Boston Globe / Il Post — Inside Anthropic’s Project Panama (2026)
[7] CourtListener — Bartz v. Anthropic PBC court documents (2025–2026)
[8] Gate News (RU) — Anthropic сканировала миллионы книг, уничтожая их (2026)
[9] Gate News (ZH) — Anthropic 过摧毁数百万本书来扫描它们 (2026)
[10] INSIDE — 快沒存本的絕版書也照碎AI公司大買舊書掃完就毀 (2026)
[11] Ars Technica — Anthropic destroyed millions of print books (2025)
[12] Il Giornale — L’IA sta divorando milioni di libri antichi e moderni (2026)
[13] AP News — Anthropic to pay authors $1.5 billion (2025)
[14] Reuters — US judge approves Anthropic’s $1.5 billion settlement (2026)
[15] Ropes & Gray — Anthropic’s Landmark Copyright Settlement: Implications (2025)
[16] The Herald Scotland — The Library of Alexandria burns again (2026)
[17] Cryptoslate / 404 Media — AI firms are shredding physical books (2026)
[18] The Boston Globe — Inside a tech company’s secretive plan to destroy millions of books (2026)

Аналитика носит информационный характер и не является инвестиционной рекомендацией. Материал подготовлен на основе судебных документов, журналистских расследований The Washington Post, 404 Media, The Boston Globe, Ars Technica, Reuters, AP News и открытых данных.

  • Последние записи

  • Больше из архива Авторское право Аналитика Искусственный интеллект Культура Технологии