Anthropic внедрила незаметный водяной знак в claude по всему миру для текста и файлов

Anthropic начала внедрять в ответы своих моделей Claude незаметную маркировку - "водяной знак", который встраивается прямо на уровне модели. Это означает, что метка появляется в тексте вне зависимости от того, откуда отправлен запрос: через веб-версию и приложения Claude, Claude Code, Claude Cowork, Claude Platform (API), а также при работе через сторонние облачные площадки вроде AWS, Google Cloud и Microsoft Foundry. Географических ограничений у схемы нет: она действует везде, где доступен Claude.

Маркировка распространяется на модели, выпущенные с 2 августа 2026 года и позже. Более ранние версии компания обещает "дооснастить" в течение переходного периода. Формальным драйвером стал подписанный Anthropic европейский кодекс практики по прозрачности материалов, созданных ИИ, однако внедрение сделали глобальным, а не только для пользователей из ЕС.

Два уровня пометок: текст и файлы

У Anthropic фактически два механизма, и работают они по-разному.

Первый - водяной знак внутри текста. Он не виден при обычном чтении и, по утверждению компании, не ухудшает качество, смысл и читаемость. Важно, что это не "наклейка" в метаданных, а часть самого текстового вывода. Поэтому метка переживает копирование и способна сохраниться после некоторых правок - но не гарантированно.

Второй - подпись происхождения для файлов. Для поддерживаемых форматов (.svg, .png, .jpg) Anthropic добавляет подписанные сведения о происхождении по открытому стандарту C2PA. Такая подпись не просто фиксирует причастность Claude к созданию или обработке файла, но и позволяет увидеть, изменялся ли файл после "подписания": данные защищены криптографически, и вмешательство обнаруживается при проверке. При этом поддержка C2PA на облачных платформах может отличаться: возможности AWS, Google Cloud и Microsoft Foundry в этой части не одинаковы.

Почему метка - не доказательство авторства

Anthropic отдельно подчеркивает ключевое ограничение: обнаруженная метка не доказывает, что материал целиком "написал Claude". На практике через модель часто прогоняют человеческие тексты - для перевода, вычитки, сокращения, переформатирования. В таком сценарии идеи и формулировки могут принадлежать человеку, но результат все равно получит отметку, потому что прошел через систему.

Верно и обратное: даже если метка была, текст могли потом существенно отредактировать, сократить, "перемешать" с другими фрагментами - и следы станут менее различимыми или исчезнут. Поэтому отсутствие метки тоже ничего окончательно не доказывает: это не подтверждение "человеческого происхождения".

Когда водяной знак может не обнаружиться

Компания перечисляет ситуации, в которых сгенерированный материал способен остаться без выявляемой отметки. В числе типичных причин - слишком короткий текст и последующие правки, которые меняют структуру настолько, что сигнал становится неуловимым. Иными словами, метка задумана как устойчивый маркер, но не как неснимаемая печать.

Что именно не раскрыто

Технической документации о том, как водяной знак внедряется и как его надежно обнаруживать, пока нет. Anthropic обещает опубликовать подробности позже - вместе с описанием инструментов проверки для пользователей и сторонних организаций: этого требует подписанный кодекс практики. Не определен и круг тех, кто получит доступ к детектированию на "официальном" уровне.

Открытым остается и принципиальный вопрос: влияет ли маркировка на сам процесс генерации - например, на выбор токенов. Если да, то это качественно иной подход по сравнению с привычными метаданными, потому что сигнал переносит уже сам текст, а не "обложка" файла.

Регуляторный контекст: ЕС и статья 50

Обязанность помечать сгенерированные материалы в машиночитаемом виде закреплена в статье 50(2) Регламента ЕС об искусственном интеллекте. Требования статьи 50 применяются с 2 августа, а для систем, выведенных на рынок до этой даты, разъяснения Еврокомиссии предусматривают ограниченный переходный период именно по обязанности маркировки. Anthropic подписала кодекс практики по прозрачности материалов, созданных ИИ, сразу в двух ролях - как поставщик генеративных моделей и как поставщик генеративных систем.

Обновления продуктов и отдельные детали

На фоне изменений в прозрачности компания продолжает двигать линейку: Anthropic, в частности, выпустила Claude Opus 5, заявив, что он вдвое дешевле Fable 5. В контексте маркировки важнее другое: новые модели с 2 августа сразу попадают под схему, а "старые" будут подтягивать поэтапно.

---

Что это меняет на практике: 8 важных выводов

1) Для редакций, PR и брендов метка становится дополнительным сигналом комплаенса: проще доказать, что вы не скрываете использование ИИ там, где это принципиально. Но полагаться только на нее нельзя - она не равна признанию авторства.

2) Для образования и найма водяной знак не превращается в "детектор списывания". Студент может принести короткий или сильно отредактированный текст без обнаруживаемой метки, и это не будет доказательством самостоятельной работы.

3) Для юристов и комплаенса в компаниях появляется новая зона риска: пометка может "прилипнуть" к документу, который вы лишь слегка отредактировали через Claude (перевели, улучшили стиль), и потом это будет интерпретироваться как "ИИ-сгенерировано". Внутренние политики должны различать генерацию с нуля и редактуру.

4) Для авторов и редакторов разумная стратегия - хранить версионность: черновики, правки, постановку задачи. Тогда спор о происхождении текста не будет упираться в одну метку.

5) Для работы с файлами C2PA-подпись полезна тем, что фиксирует факт последующих изменений. Если изображение "пересохраняли", перекодировали или правили, это может проявиться при проверке и повлиять на доверие к контенту.

6) Для площадок и маркетплейсов контента вероятен рост автоматических правил модерации: если появятся массовые инструменты обнаружения, платформы начнут помечать или ранжировать материалы иначе. Но ошибки неизбежны: метка говорит лишь о возможной обработке.

7) Для исследователей и разработчиков остается интрига, насколько устойчив водяной знак к агрессивному "переписыванию", синонимизации и стилевым преобразованиям. Чем сильнее устойчивость, тем выше ценность для прозрачности - но тем больше вопросов к влиянию на генерацию.

8) Для обычных пользователей главный принцип простой: метка - не клеймо и не сертификат качества. Это технический маркер прохождения через конкретную систему, который удобен для прозрачности, но не решает задачу установления истинного автора.

В итоге Anthropic делает ставку на "встроенную" прозрачность: пометка появляется автоматически и одинаково в разных каналах доступа к Claude. Однако до публикации подробной технической схемы и общедоступных инструментов проверки эта инициатива остается скорее инфраструктурным обещанием - полезным для экосистемы, но не превращающимся в универсальный арбитр споров о происхождении текста.

Прокрутить вверх