цифровое рабство
Yesterday

Они не просто обучают ИИ. Они уничтожают книги

Есть история, которая выглядит настолько абсурдно, что сначала хочется списать её на очередную интернет-конспирологию. Но если собрать детали вместе, получается куда более неприятная картина.

Компании, работающие с искусственным интеллектом, якобы начали скупать огромные партии книг — включая редкие и практически исчезнувшие из обращения издания. Дальше запускается промышленный конвейер: книги массово сканируют на высокоскоростных установках, корешки срезают, страницы проходят через сканер, а бумажные оригиналы отправляются в уничтожение.

И вот здесь возникает главный вопрос: зачем уничтожать то, что только что оцифровали?

Ответ выглядит пугающе просто: чтобы после создания цифровой копии физический экземпляр больше не существовал.

Получается своеобразная лазейка. Если оригинал уничтожен, можно утверждать, что одновременно существует только одна копия книги — цифровая. А значит, уничтожение бумажного экземпляра превращается из уничтожения культурного объекта в нечто, что юридически можно трактовать как часть процесса оцифровки.

Именно на этом фоне особенно интересно выглядит история с американским судом, который признал подобную практику добросовестным использованием в определённых обстоятельствах.

Но есть одна деталь, о которой почему-то хочется говорить особенно громко.

Книга может быть единственной.

Можно восстановить сайт. Можно заново напечатать миллион экземпляров современного бестселлера. Можно скачать цифровой файл.

Но если существовало три экземпляра редчайшего научного труда XVIII века, а все три отправили под ножи промышленного сканера, восстановить их уже не получится.

Никаким алгоритмом.

Никаким резервным копированием.

Никакой нейросетью.

И вот тут история перестаёт быть просто разговором о технологиях.

Миллион книг — и никто не должен знать

Отдельный интерес представляет инфраструктура вокруг этого процесса.

Существуют сервисы, через которые можно организовывать масштабные закупки книг, причём в некоторых случаях речь идёт о сотнях тысяч и даже миллионах экземпляров. Одновременно предлагаются механизмы, позволяющие скрывать конечного покупателя и заключать соглашения о неразглашении.

На языке бизнеса это называется конфиденциальностью.

Если смотреть на ситуацию глазами конспиролога, название получается совсем другим:

кто-то покупает историю человечества оптом и очень не хочет объяснять, зачем.

Особенно странно выглядит сама логика рынка. Книга, напечатанная до массового распространения генеративного ИИ, становится своеобразным «чистым» источником человеческого текста. В ней нет сгенерированного нейросетью контента. Это буквально слепок человеческой письменной культуры до эпохи машинного производства текста.

И поэтому такие книги становятся сырьём.

Не для библиотек.

Не для коллекционеров.

Не для музеев.

А для машин.

Самое странное — что уничтожение становится частью бизнес-модели

Есть ещё более мрачная деталь.

По описанию участников этого рынка, в такой конвейер могут попадать экземпляры, которые пережили войны, пожары, переезды, закрытие библиотек и десятилетия человеческого обращения.

Книга могла пролежать сто или двести лет.

Её могли держать в руках несколько поколений.

Она могла оказаться одной из последних сохранившихся копий.

А затем появляется современная машина.

Она отрезает корешок.

Страницы пролетают через сканер.

Файл оказывается на сервере.

А оригинал превращается в бумажное сырьё.

Вот так выглядит цифровое сохранение в его самой странной версии.

Сохранили настолько хорошо, что уничтожили сам предмет сохранения.

«Все книги мира»

Особенно символично выглядит история вокруг Anthropic, которая наняла бывшего руководителя направления Google Books. Само по себе это кадровое решение может быть совершенно обычным.

Но в контексте происходящего оно приобретает другой смысл.

Google десятилетиями занималась оцифровкой библиотечных фондов.

Теперь же индустрия искусственного интеллекта заинтересована в другом ресурсе — не просто в отдельных книгах, а в максимально полном массиве человеческих текстов.

Чем больше книг попадёт в обучающие наборы, тем больше человеческого знания окажется внутри машин.

И здесь возникает вопрос, который уже невозможно игнорировать:

где заканчивается цифровое сохранение и начинается приватизация культурного наследия?

А что, если это только начало?

Самая неприятная часть истории заключается даже не в том, что какие-то книги уничтожают.

А в том, что экономическая логика здесь может работать сама по себе.

Если редкую книгу можно купить относительно дёшево, быстро просканировать, уничтожить физический экземпляр и использовать полученные данные для обучения коммерческой системы, то появляется финансовый стимул делать это снова.

И снова.

И снова.

Пока рынок не начнёт забирать всё, что ещё можно купить.

Сегодня это редкое издание, которого осталось несколько десятков.

Завтра — несколько экземпляров.

А потом кто-то обнаруживает последнюю сохранившуюся книгу определённого автора и задаёт совершенно рациональный с точки зрения бизнеса вопрос:

«Сколько стоит её цифровая копия?»

И совершенно иррациональный с точки зрения культуры:

«А зачем нам вообще оставлять оригинал?»

Вот здесь и появляется настоящий страх.

Потому что цифровая копия может сохранить содержание.

Но она не сохраняет сам объект.

Не сохраняет бумагу.

Запах.

Типографику.

Переплёт.

Следы времени.

Пометки владельца.

Историю конкретного экземпляра.

И главное — возможность существования физического оригинала через сто или двести лет.

Мы привыкли думать, что искусственный интеллект поглощает данные.

Возможно, проблема в другом.

Он начинает поглощать сами источники этих данных.

А если верить наиболее мрачной версии этой истории, мы можем оказаться в ситуации, когда человечество сначала отдаст машинам свои книги, затем уничтожит бумажные оригиналы, а потом обнаружит, что значительная часть собственной культурной памяти существует только внутри частных серверов корпораций.

И тогда вопрос будет уже не в том, что ИИ умеет писать.

Вопрос будет гораздо неприятнее:

кому принадлежит человеческая память после того, как последние оригиналы отправились в шредер?