Anna's Archive обвинила Anthropic в тайном уничтожении книг ради обучения ИИ

Anna's Archive, крупная теневая библиотека, опубликовала в своём блоге 5 августа 2026 года гостевой текст волонтёра под псевдонимом «u» (перевод с китайского). Автор утверждает: несколько ИИ-компаний тайно скупают через посредников большие партии бумажных книг, сканируют их и затем уничтожают, и всё ради обучающих данных, «не тронутых машинами», то есть созданных до 2022 года, когда в интернете ещё не было текста, сгенерированного самим ИИ.

Единственная компания, названная по имени, Anthropic. По словам автора, в начале 2024 года компания запустила строго засекреченный проект «Project Panama»: потратила десятки миллионов долларов на закупку миллионов бумажных книг, отсканировала их для обучения своей модели Claude, а затем уничтожила все экземпляры. Автор утверждает, что эта практика «вскрылась» в рамках урегулирования иска о нарушении авторских прав на $1,5 млрд, но не приводит ни ссылки, ни названия дела, ни какого-либо другого источника ни для этой суммы, ни для самого существования «Project Panama».

Три причины, которые автор называет для уничтожения книг после сканирования: во-первых, оригиналы не достанутся конкурентам для их собственного обучения; во-вторых, так ниже юридические риски; в-третьих, уничтожение дешевле, чем бережное сканирование, при котором книга остаётся целой. Итог, как его описывает автор: ИИ-компании остаются единственными в мире обладателями цифровых копий, и знания оказываются заперты на частных серверах, вместо того чтобы стать общедоступными, как обещает риторика ИИ-индустрии о «доступности человеческих знаний».

Дальше пост превращается в призыв к действию: Anna's Archive просит волонтёров по всему миру сканировать и загружать в теневую библиотеку книги, журналы, газеты и редкие издания, прежде всего те, что рискуют пропасть безвозвратно. За небольшие партии сканов обещаны признание и пожизненное членство в Anna's Archive; за крупные, оплата расходов на сканирование и другие вознаграждения. Автор подкрепляет срочность призыва цифрой: с начала 2025 года более половины нового контента в интернете уже создано ИИ, и если бумажные архивы уничтожат раньше, чем их успеют оцифровать независимо от ИИ-компаний, отличить человеческий текст от машинного в будущем станет невозможно.

Ключевые факты

  • Anna's Archive опубликовала 5 августа 2026 года гостевой пост волонтёра под псевдонимом «u» (перевод с китайского) с призывом срочно сканировать редкие книги.
  • Пост утверждает: несколько ИИ-компаний тайно скупают через посредников, сканируют и уничтожают бумажные книги ради обучающих данных «до эпохи ИИ», созданных до 2022 года.
  • Единственный названный пример, Anthropic: операция «Project Panama» (запущена, по словам автора, в начале 2024 года), десятки миллионов долларов на закупку миллионов книг, обучение модели Claude и уничтожение экземпляров; автор пишет, что практика «вскрылась» в урегулировании иска на $1,5 млрд, но источник этой информации не приводит.
  • Автор называет три причины уничтожать книги после сканирования: не дать их конкурентам, снизить юридические риски, сэкономить на бережном сканировании.
  • Anna's Archive предлагает волонтёрам признание и пожизненное членство за небольшие сканы, оплату расходов, за крупные, и утверждает, что с начала 2025 года более половины нового контента в интернете уже создано ИИ.

Почему это важно

Пост поднимает вопрос, который давно обсуждается вокруг обучения больших ИИ-моделей: откуда компании берут данные и что происходит с оригиналами после того, как текст оцифрован. По утверждению автора, компании вроде Anthropic целенаправленно ищут материалы «до эпохи ИИ» (до 2022 года), потому что такой текст гарантированно не сгенерирован самим ИИ, и ради этого готовы уничтожать бумажные экземпляры, а не просто их сканировать. Если хотя бы часть этих утверждений подтвердится независимо, это добавит аргументов к судебным спорам об авторских правах вокруг обучения ИИ и к спору о том, кто в итоге контролирует доступ к печатному наследию человечества, открытые библиотеки или частные серверы корпораций.

Кому это важно

Издателям, авторам и правообладателям, которые следят, как ИИ-компании закупают материал для обучения моделей. Библиотекам, архивам и коллекционерам редких книг, потенциальным держателям материалов, которые теневые библиотеки просят оцифровать. Юристам и журналистам, которые разбирают споры об авторских правах вокруг обучения ИИ, включая дела с участием Anthropic. Волонтёрам теневых библиотек и всем, кто интересуется темой сохранения печатного наследия в эпоху ИИ.

Как это применить

Практический план поста конкретен: сканировать книги, журналы, газеты и редкие материалы, особенно те, что рискуют пропасть безвозвратно, и загружать сканы в Anna's Archive. За небольшие партии автор обещает признание и пожизненное членство в сервисе; для крупных объёмов Anna's Archive предлагает частично оплатить расходы на сканирование и другие вознаграждения. Прежде чем участвовать, стоит понимать, во что именно вкладываешься: Anna's Archive прямо называет себя теневой библиотекой, а не легальным архивным проектом (подробнее, в разделе «Риски и подводные камни»).

Можно ли доверять

Источник, не независимая журналистика, а гостевой пост в блоге самой Anna's Archive: теневой библиотеки, которая в этом же тексте просит у читателей волонтёров и деньги, то есть заинтересована представить угрозу как можно масштабнее. Автора источник называет только псевдонимом «u», реального имени, должности или места работы, кроме статуса «волонтёр Anna's Archive», не приведено. Ключевые фактические детали о конкретной компании, что операция Anthropic называлась «Project Panama», что она была строго засекречена, что запущена именно в начале 2024 года и что «вскрылась» в урегулировании иска на $1,5 млрд, даны без единой ссылки, без названия судебного дела и без какого-либо другого проверяемого источника. Точная дата, когда книги были уничтожены, тоже не названа, только дата запуска проекта и дата публикации самого поста. Даже число уничтоженных экземпляров источник отдельно не подтверждает: единственная цифра («миллионы книг») стоит при закупке, а формулировка «уничтожила все» просто приравнивает её к уничтоженному, не называя это число напрямую. Из «нескольких ИИ-компаний», которые, по утверждению поста, скупают и уничтожают книги, поимённо назван только Anthropic. Тон текста, не нейтральное изложение, а эмоциональная агитация («тягчайшее преступление против человечности»), написанная ради вербовки волонтёров. Это не значит, что описанной практики не существует, но по единственному анонимному источнику без единой ссылки проверить детали невозможно.

Риски и подводные камни

Главный риск для читателя, принять непроверенное обвинение за установленный факт: конкретные цифры (сумма урегулирования, объём закупленных и уничтоженных книг) в посте не подкреплены ссылками и могут быть неточны. Отдельный риск, уже для потенциального волонтёра: загрузка сканов в сервис, который сам называет себя «крупнейшей теневой библиотекой мира», то есть площадкой для распространения книг в обход авторского права, может обернуться юридическими проблемами для самого волонтёра, а не только для критикуемых ИИ-компаний. Есть и конфликт интересов: Anna's Archive одновременно и обвинитель, и сторона, получающая выгоду (волонтёров, пожертвования, сканы) от того, что читатель поверит в масштаб угрозы. Если же описанная практика окажется реальной хотя бы отчасти, актуален и риск, о котором говорит сам пост: безвозвратная потеря части бумажного культурного наследия и монополизация знаний на серверах отдельных корпораций, если больше никто не успеет оцифровать книги независимо.

«Возмутительно, что уничтожать книги после сканирования разрешено законом, но с этической точки зрения это тягчайшее преступление против человечности.»

— Волонтёр Anna's Archive «u»