Anthropic встроила в ответы Claude водяные знаки, часть пользователей возмущена

Anthropic встроила в ответы Claude водяные знаки, часть пользователей возмущена

Anthropic начала встраивать в текстовые ответы Claude невидимый код, водяной знак, который помечает текст как сгенерированный ИИ. Решение объясняется требованиями Кодекса прозрачности Евросоюзского закона об ИИ (EU AI Act): он обязывает технологические компании маркировать контент, созданный или отредактированный ИИ, так, чтобы это опознавали компьютерные системы. Официального заявления Anthropic по этому поводу в статье не приводится, причина указана от лица издания.

Новость вызвала спор на Reddit. Пользователь под ником visionode, чей аккаунт на момент публикации существует всего три недели, назвал новую систему водяных знаков «драконовским заговором», нацеленным на невиновных пользователей чат-бота. По мнению visionode, опытные пользователи Claude смогут скрыть следы использования ИИ, перефразировав текст через другие ИИ-сервисы, а рядовые пользователи, попадутся. Он привёл конкретные примеры: «Кто попадётся? Вы. Студент, который попросил Claude переставить местами абзац. Журналист, который попросил ИИ пересказать стенограмму на двести страниц. Писатель, у которого не шла работа и который попросил подобрать синонимы. Все они выходят из этого процесса с цифровым клеймом на лбу».

Автор материала TechCrunch не согласился с этими примерами: журналиста, попросившего ИИ пересказать двухсотстраничную стенограмму, водяной знак на этом пересказе не должен беспокоить, если только он не собирается вставить пересказ дословно в свою статью, что само по себе неэтично. То же касается студента, который вставляет ответ Claude в эссе после просьбы «переставить абзац местами».

Другие пользователи Reddit не поддержали возмущение visionode: один ограничился ироничным «ну надо же», другой посоветовал «сделать глубокий вдох». Ещё один недовольный пользователь назвал водяные знаки «неэтичными» и «отвратительными», заявив, что львиную долю работы над своим текстом или кодом сделал сам, а Claude был лишь «инструментом»: «Я дал инструкции, контекст, решения и бесчисленные правки, Claude был инструментом. Если Claude начинает ставить водяные знаки на код или что-либо ещё, что он генерирует, на что именно он претендует?» Ему ответили: «Дело не в претензии на авторство. Дело в возможности обнаруживать сгенерированный ИИ контент, из-за рисков, которые он может создавать в разных ситуациях». Третий добавил: «Чувак не смог даже пожаловаться на Claude без помощи Claude».

Прозвучал и более взвешенный аргумент об иронии происходящего: один из пользователей указал на лицемерие в том, что редакторский продукт, сам обученный на чужих текстах без спроса, теперь ставит водяные знаки на результат чужой работы с ним, «пугающая ирония, учитывая, откуда передовые модели берут свои обучающие данные». В целом же, по наблюдению автора статьи, большинство пользователей поддержали систему водяных знаков как разумный способ отслеживать сгенерированный алгоритмом материал: один из комментаторов написал, что нет ни одной весомой причины быть против этого, «единственная причина не хотеть этого, желание обманывать людей».

Ключевые факты

  • Anthropic встраивает в ответы Claude невидимый водяной знак, помечающий текст как сгенерированный ИИ, чтобы выполнить требования Кодекса прозрачности EU AI Act.
  • Пользователь Reddit visionode (аккаунту три недели) назвал систему «драконовским заговором» против рядовых пользователей, студентов, журналистов, писателей.
  • Автор TechCrunch указал: примеры visionode неудачны, поскольку дословное копирование ответа ИИ в чужую работу и так неэтично независимо от водяного знака.
  • Часть Reddit-пользователей высмеяла жалобы visionode и другого критика, назвавшего Claude просто «инструментом» своей работы.
  • Большинство комментаторов, по данным статьи, поддержали водяные знаки как способ отслеживать ИИ-контент; статья не приводит официального комментария Anthropic.

Почему это важно

Это заметный публичный отклик пользователей на то, как крупная ИИ-компания на практике выполняет требование EU AI Act маркировать сгенерированный контент. Водяной знак невидим для человека, но опознаётся системами, то есть превращает вопрос «писал текст человек или ИИ» из предположения в проверяемый факт, причём без ведома автора текста в момент, когда он его создаёт.

Кому это важно

Тем, кто использует Claude для учёбы, работы или журналистики и затем выдаёт его вывод за собственный текст без переработки, водяной знак делает такую выдачу проверяемой. Также это важно для компаний и регуляторов в ЕС, которым нужен работающий механизм маркировки ИИ-контента, и для самой Anthropic, которой приходится балансировать между требованием закона и недовольством части аудитории.

Как это применить

Прямого практического действия для пользователя здесь нет, водяной знак ставится автоматически и невидимо. Единственный практический вывод из спора на Reddit: ответ Claude, вставленный дословно в чужую работу без переработки, технически опознаваем как сгенерированный ИИ, а такое использование уже до водяных знаков считалось неэтичным.

Можно ли доверять

Материал TechCrunch, не сухая новостная заметка, а колонка с явной авторской позицией: автор прямо спорит с примерами visionode и называет некоторые действия пользователей неэтичными. Фактическая часть (сам факт запуска водяных знаков и причина, EU AI Act) не подкреплена цитатой представителя Anthropic, а цитаты пользователей Reddit анонимны, кроме visionode; данных о том, сколько людей поддерживает или критикует меру, в статье нет, только качественное впечатление автора, что поддержки больше.

Риски и подводные камни

Главный риск для Anthropic, репутационный: часть аудитории воспринимает невидимую маркировку как слежку за собой, даже если формальная цель, не наказание, а прозрачность для регуляторов. Для пользователей риск в другом: водяной знак не различает добросовестное использование (пересказ, помощь с формулировками) и недобросовестное (выдача чужого текста за свой), обе ситуации помечаются одинаково, а различие остаётся на совести самого пользователя.

«Нет ни одной весомой причины считать, что это плохая идея. Единственная причина не хотеть этого, желание обманывать людей.»

— пользователь Reddit