Anthropic готовит заметное изменение для Claude: будущие модели компании будут автоматически оставлять в сгенерированном тексте невидимый статистический «водяной знак». Пользователь не увидит никаких дополнительных символов, меток или служебного кода, однако специальная система сможет определить вероятность того, что текст создавался с участием Claude. Компания внедряет технологию в рамках требований европейского AI Act и Кодекса практики по прозрачности ИИ-контента, который Anthropic подписала в июле 2026 года вместе с другими участниками рынка. Причем применять watermark компания намерена глобально, а не только в Евросоюзе. Anthropic объясняет это тем, что пока не располагает надежным способом ограничить работу технологии отдельными регионами.
Как работает невидимый watermark Claude
Читайте также
ИИ предсказывает вспышки на Солнце и потепление Земли: что ждёт человечество
Водяной знак не вставляется в готовый текст после его создания. Он формируется непосредственно в процессе генерации. Языковые модели последовательно выбирают следующие слова или токены из нескольких подходящих вариантов. Иногда различия между ними практически не влияют на смысл. Например, модель может выбирать между двумя одинаково уместными прилагательными. В обычном режиме итоговый вариант частично зависит от случайности. Watermark меняет источник этой случайности. Claude использует специальный ключ и предыдущие слова, чтобы делать выбор таким образом, чтобы во всем тексте постепенно возникал статистический паттерн. Для человека он незаметен, но система, располагающая соответствующим ключом, сможет его обнаружить. Anthropic использует версию технологии SynthID-Text, разработанной Google DeepMind. По данным компании, внутренние тесты не выявили влияния watermark на содержание, креативность или читаемость ответов. Дополнительные токены также не создаются, поэтому механизм практически не должен влиять на скорость работы или стоимость использования Claude.
Можно ли определить любой текст Claude
У технологии есть ограничения. Короткие фрагменты проверять сложнее: чем меньше модель сделала вариантов выбора слов, тем слабее статистический сигнал. То же касается текста с большим количеством точных фактов и программного кода, где часто существует лишь один корректный вариант продолжения. Если пользователь попросил Claude только исправить несколько ошибок в собственном тексте, водяной знак также может оказаться слишком слабым для уверенного обнаружения. Чем больше текста самостоятельно генерирует модель, тем выше вероятность найти характерный паттерн. Есть и более очевидная проблема: watermark можно ослабить редактированием. По словам Anthropic, небольшие правки, вероятно, не уничтожат его полностью, однако глубокое переписывание текста способно убрать исходный сигнал. Поэтому технология не является абсолютным детектором ИИ. Она показывает лишь вероятность того, что Claude участвовал в создании или существенном редактировании материала.
Anthropic запустит API для проверки текстов
Компания также готовит специальный API для обнаружения водяных знаков Claude, однако подробности его работы и сроки полноценного запуска пока не раскрываются. Старые модели Claude, выпущенные до 2 августа 2026 года, получили переходный период, но Anthropic планирует постепенно добавить watermark и в них в течение следующих месяцев. Для пользователей важен еще один момент: водяной знак не содержит информации о личности, аккаунте, компании или конкретном чате. Он позволяет установить только возможное участие Claude в создании текста. Таким образом, Anthropic фактически превращает происхождение AI-контента в проверяемый математический признак — шаг, который вскоре может стать стандартом для всей индустрии генеративного ИИ.





