← На главную
Новости· 17.08.2026· 3 мин чтения

Claude теперь ставит невидимые метки на каждый сгенерированный текст — вот как это устроено

Anthropic внедряет водяные метки в текст Claude для соответствия EU AI Act. Как это работает, зачем нужно и почему не замедлит генерацию

Claude теперь ставит невидимые метки на каждый сгенерированный текст — вот как это устроено
Материал подготовлен с помощью ИИ и проверен редактором

Anthropic впервые подробно объяснила, как будет работать система водяных меток (watermarking) в текстах, созданных её моделью Claude. Это требование Евросоюза: с 2026 года любой синтетический контент — текст, изображения, аудио — должен содержать машинно-читаемую метку, по которой можно определить его искусственное происхождение. Для пользователей ничего не изменится: качество генерации не упадёт, а стоимость не вырастет. Но теперь каждый абзац, написанный Claude, можно будет проверить на подлинность — если знать секретный ключ.

Почему это появилось именно сейчас

Европейский закон об искусственном интеллекте (EU AI Act) вступил в силу в августе 2026 года. Одно из ключевых требований — прозрачность генеративных моделей. Любой контент, созданный или изменённый ИИ, должен содержать невидимую метку, которая позволяет однозначно идентифицировать его как синтетический. Это касается не только Anthropic: Google уже внедрила аналогичную систему SynthID-Text в Gemini в 2024 году, а OpenAI пока не раскрыла свои планы по водяным меткам для ChatGPT, но тоже обязана их реализовать.

Anthropic выбрала подход, основанный на открытой технологии от Google DeepMind. Компания не раскрывает все детали своей реализации, но подтверждает, что использует «версию SynthID-Text» — это значит, что базовый принцип остаётся тем же.

Как работает водяная метка в тексте

Представьте, что Claude генерирует предложение: «Погода сегодня была холодная и...». Следующее слово может быть «пасмурная» или «серая» — оба варианта подходят по смыслу, и для читателя разница несущественна. Обычно модель выбирает слово случайным образом, используя стандартный генератор случайных чисел.

При включённой водяной метке процесс меняется. Вместо произвольного выбора Claude использует секретный ключ и несколько предыдущих слов, чтобы определить, какое слово подставить. В результате в тексте появляется незаметный для человека, но детектируемый алгоритмом паттерн. Этот паттерн и есть водяная метка.

Anthropic подчёркивает: метка не влияет на качество текста. Пользователь не заметит разницы — ни в скорости генерации, ни в связности, ни в стиле. Единственное отличие — теперь текст можно проверить на подлинность с помощью специального инструмента, который знает секретный ключ.

Что это значит для пользователей и разработчиков

Для обычных пользователей Claude изменений не будет. Модель продолжит генерировать текст так же быстро и качественно, как и раньше. Но появится новая возможность: если вы подозреваете, что текст написан ИИ, вы сможете проверить его с помощью инструмента от Anthropic (или сторонних решений, которые появятся позже).

Для разработчиков и компаний, интегрирующих Claude через API, ситуация интереснее. Теперь у них есть инструмент для борьбы с нежелательным использованием ИИ-контента. Например:

  • Соцсети смогут автоматически помечать посты, написанные ИИ.
  • Новостные агрегаторы — фильтровать синтетические новости.
  • Образовательные платформы — выявлять плагиат с помощью ИИ.

При этом Anthropic предупреждает: водяные метки не идеальны. Если текст сильно отредактировать вручную, метка может стать менее заметной или вовсе исчезнуть. Особенно это касается кода: для него Anthropic использует более слабую версию водяной метки, потому что даже небольшие правки могут нарушить паттерн.

Где это может сломаться

Водяные метки — не панацея. Вот основные ограничения технологии:

  1. Ручная правка. Если человек перепишет 30-40% текста, метка может перестать определяться. Особенно это актуально для коротких текстов.
  2. Перевод. При переводе на другой язык паттерн может нарушиться, хотя Anthropic утверждает, что их система устойчива к некоторым видам трансформаций.
  3. Код и технические тексты. Здесь водяные метки работают хуже, потому что даже небольшие изменения (например, переименование переменной) могут разрушить паттерн.
  4. Закрытые ключи. Метку можно обнаружить только с помощью инструмента, который знает секретный ключ. Если ключ утечёт или будет взломан, система потеряет эффективность.

Ещё один риск — ложные срабатывания. Теоретически можно создать текст, который случайно совпадёт с паттерном водяной метки, и он будет ошибочно помечен как сгенерированный ИИ. Но Anthropic утверждает, что вероятность такого события крайне мала.

Что дальше

Водяные метки в тексте — это только начало. Евросоюз требует маркировать не только текст, но и изображения, аудио и видео. Anthropic уже поддерживает стандарт C2PA для изображений, созданных Claude, а в будущем аналогичные системы появятся и для других типов контента.

Для индустрии это означает переход в новую реальность, где синтетический контент можно будет отличать от человеческого. Вопрос не в том, нужно ли это делать, а в том, как это будет работать на практике. Пока что водяные метки — самый перспективный подход, но их эффективность ещё предстоит проверить в реальных условиях.

А пока пользователи могут продолжать использовать Claude как обычно — просто теперь каждый сгенерированный текст будет нести в себе невидимую подпись.

Источники

Материал подготовил PLai AI — редакционный ИИ PLai.

Он же отбирает источники, пишет тексты и модерирует комментарии. Работает на PLGames AI — собственном шлюзе к языковым моделям.

Читайте также

Комментарии

Пока никто не написал. Будьте первым.

Комментарии проверяет AI-модератор PLai. По существу — публикуется сразу.

Как работает невидимая водяная метка в Claude — объяснение от Anthropic — PLai