22 сентября 2026

Искусственный интеллект

Anthropic теперь добавляет водяные знаки в тексты ИИ Claude, и вот как это работает

Опубликовано , автор Shalom Levytam

Компания Anthropic подробно рассказала о том, как будущие модели Claude будут содержать водяные знаки в своих текстовых выводах. Это нововведение, по заявлению компании, требуется в соответствии с правилами прозрачности Закона ЕС об искусственном интеллекте (AI Act). Водяной знак создается путем незаметного влияния на то, как Claude выбирает между одинаково подходящими словами — например, выбирает «пасмурный» вместо «серый» при описании погоды. Получившийся узор незаметен для читателей, но любой обладатель соответствующего ключа может оценить вероятность того, что данный фрагмент был сгенерирован или обработан Claude. Anthropic также планирует выпустить API для обнаружения водяных знаков.

Anthropic Is Now Watermarking Claude's AI Text, Here's How It Works

Компания опубликовала дополнительные детали после того, как ее предыдущее объявление вызвало бурные обсуждения среди пользователей Claude в связи с новым требованием о нанесении водяных знаков. По заявлению Anthropic, этот подход не оказывает практического влияния на качество вывода, не добавляет скрытых символов, не требует дополнительных токенов и не содержит никакой идентифицирующей информации, которую можно было бы отследить до конкретного пользователя, организации или чата.

Claude использует версию метода SynthID-Text, опубликованную исследователями Google DeepMind в журнале Nature в 2024 году. Эта техника оказывает ничтожно малое влияние на скорость работы, не увеличивает затраты и отличается от традиционного программного обеспечения для обнаружения ИИ, которое ищет стилистические паттерны, а не проверяет закодированный ключ. Компания также заявляет, что другие крупные разработчики моделей, подписавшие Кодекс практики ЕС, внедрят собственные системы нанесения водяных знаков.

Система работает лучше всего на длинных текстах, где у Claude больше возможностей для произвольного выбора слов. Легкая правка, скорее всего, не удалит маркер полностью, но полная переработка, при которой заменяется каждое слово, — удалит. Anthropic подчеркивает, что система может лишь оценить, участвовал ли Claude в создании или редактировании фрагмента текста, но не доказать авторство или провести различие между текстом, сгенерированным ИИ, и текстом, отредактированным ИИ в значительной степени. Аналогичным образом, если Claude занимается только корректурой или легкой правкой человеческого текста, слов, выбранных Claude, может оказаться слишком мало для надежного обнаружения.

Код, как правило, содержит меньше водяных знаков по сравнению с другими формами текста, поскольку в нем меньше возможностей для выбора между равноценными альтернативами, хотя комментарии и другие произвольные текстовые элементы все же могут быть помечены. Переводы, выполненные Claude, также содержат водяной знак, поскольку каждое слово выбирается моделью.

Для изображений и других поддерживаемых типов файлов Claude вместо этого будет добавлять учетные данные контента C2PA в метаданные файла. Anthropic применяет это изменение во всем мире, поскольку у нее пока нет надежного способа ограничить добавление водяных знаков по регионам. Компания сообщает, что старые модели Claude получат поддержку водяных знаков в ближайшие месяцы в рамках переходного периода Закона ЕС об искусственном интеллекте.

Искусственный интеллект. Читайте также на iClarified.ru.