Теперь Claude может наносить незаметную пометку на ваш текст, даже если вы написали его самостоятельно

Компания Anthropic внедрила новую систему, которая встраивает невидимые водяные знаки непосредственно в текст, сгенерированный моделью Claude. В отличие от метаданных, привязанных к документу или изображению, новая система маркировки разработана таким образом, чтобы сопровождать сгенерированный текст при его копировании и вставке в другие места и может сохраняться даже после некоторых последующих правок.
Европейский Союз может взять на себя по крайней мере часть заслуг — или вины — за эту разработку. Компания Anthropic заявляет, что в качестве поставщика как генеративных моделей ИИ, так и соответствующих систем она подписала Кодекс практики по прозрачности контента, сгенерированного искусственным интеллектом, предусмотренный статьёй 50(2) Закона ЕС об искусственном интеллекте. Новая схема маркировки представляет собой способ, с помощью которого компания в настоящее время намерена воплотить эти обязательства в жизнь, хотя она внедряет её по всему миру, а не ограничивается только тем регионом, который стоял у истоков данного регуляторного инициативы.
Компания сообщает, что все модели Claude, запущенные 2 августа 2026 года или позднее, будут поддерживать эту технологию с момента запуска. Anthropic также намерена со временем распространить эту функцию на более старые модели. Кроме того, система не ограничивается рынками, где требования к маркировке контента, сгенерированного ИИ, могут сделать такие меры необходимыми, поскольку компания внедряет её по всему миру.
Anthropic не раскрывает, как именно работает водяной знак
По словам Anthropic, водяной знак вплетается непосредственно в текстовый вывод Claude без видимого изменения итогового ответа. Это принципиально отличает его от традиционных метаданных о происхождении, которые могут просто исчезнуть в тот момент, когда контент отделяется от исходного файла.
Как именно Anthropic этого добивается, пока остаётся загадкой. До настоящего момента компания отказывалась публиковать подробную техническую документацию, объясняющую, как встраивается или обнаруживается текстовый водяной знак. Тем не менее она утверждает, что маркировка не влияет на «смысл, качество или стиль» ответов Claude.
Система также значительно выходит за рамки ориентированного на потребителей чат-бота Claude. По заявлению Anthropic, поддерживаемые модели генерируют текст с водяными знаками при доступе через Claude, Claude Code, Cowork, собственный API и сторонние облачные платформы. Таким образом, разработчики, использующие модели Claude нестандартными способами, также подпадают под действие нового режима отслеживания происхождения.
В перспективе компания Anthropic планирует предоставить механизмы обнаружения третьим сторонам, хотя пока не раскрывает, как именно будут работать эти инструменты и кому будет разрешено ими пользоваться.
Как ни парадоксально, наличие водяного знака Claude не доказывает, что текст был написан именно Claude
Существует, однако, довольно существенное ограничение. Обнаружение водяного знака Claude не обязательно означает, что именно Claude создал исходный материал. Любой текст, прошедший через Claude, потенциально может получить этот знак, в результате чего его наличие станет скорее свидетельством участия Claude, чем доказательством авторства ИИ.
Сама компания Anthropic признает, что текст, полностью написанный человеком, может получить водяной знак после обработки в системе Claude. Например, автор может самостоятельно написать всю статью, а использовать Claude лишь для корректуры, перевода или редактирования. Тем не менее, итоговый текст может содержать невидимый знак Claude.
Любой, кто решит избавиться от упомянутого водяного знака, будет вынужден прибегнуть к обширной редактуре, перефразированию, переводу или объединению результатов работы Claude с другими материалами, что фактически сведет на нет саму цель этой технологии. Также представляется неизбежным, что данная технология породит множество мелких предприятий, специализирующихся на удалении этого «проклятого» водяного знака из текстов, сгенерированных Claude.
Таким образом, сложившаяся ситуация носит несколько парадоксальный характер. Положительный результат может указывать на то, что Claude в какой-то момент обрабатывал данный фрагмент текста, но не позволяет однозначно утверждать, что именно Claude его написал. И наоборот, отсутствие обнаруживаемого водяного знака не обязательно доказывает, что Claude не имел к этому никакого отношения.
Поможет ли это на самом деле сократить количество некачественного контента, создаваемого ИИ? Вероятно, нет
По сути, это возвращает нас к исходной точке, поскольку наличие или отсутствие водяного знака Claude ничего не доказывает. Похоже, распространение некачественного контента, сгенерированного ИИ, будет продолжаться беспрепятственно, по крайней мере в обозримом будущем.
Тем не менее это создаёт тревожный прецедент для других компаний, занимающихся ИИ, которые, несомненно, последуют примеру Anthropic и попытаются встроить механизмы подтверждения происхождения в результаты работы своих ИИ-систем. Таким образом, фраза «Мы не загрязняем наши результаты невидимыми отметками» станет вполне легитимным маркетинговым слоганом для компаний, работающих в сфере ИИ, в ближайшем будущем.
Изображения и некоторые другие файлы, сгенерированные с помощью Claude, обрабатываются иначе. Компания Anthropic использует C2PA Content Credentials для поддерживаемых нетекстовых результатов, прикрепляя к сгенерированным файлам криптографически подписанную информацию о происхождении, а не применяя к ним ту же технику текстового водяного знака.
На данный момент, пожалуй, самым большим нерешённым вопросом остаётся то, из чего на самом деле состоит невидимая текстовая маркировка Claude. Если система влияет на выбор токенов во время генерации, её реализация и потенциальное влияние на результаты модели могут оказаться значительно более интересными, чем традиционная прослеживаемость на основе метаданных.
Компания Anthropic сообщает, что в будущем будет опубликована дополнительная техническая документация, касающаяся её подхода к нанесению водяных знаков. До тех пор точно неизвестно, что именно делает Claude «за кулисами».









