Пладром

11 Август 2026

Поиск
Claude получит невидимую машинную метку в тексте
Зображення: символ Claude / Wikimedia Commons, CC0

Наука

Claude получит невидимую машинную метку в тексте

Anthropic вводит watermark на уровне модели и подписанные данные о происхождении файлов. Это разные технологии, и ни одна из них не является безошибочным детектором ИИ.

Anthropic меняет способ, которым можно будет отслеживать происхождение контента Claude. Поддерживаемые модели станут встраивать в сгенерированный текст невидимый для человека машинно-читаемый watermark, а поддерживаемые файлы — получать цифровую подпись данных о происхождении.

Дату 2 августа 2026 года при этом важно трактовать точно. В этот день начали применяться требования статьи 50 европейского AI Act о прозрачности генерируемого контента. Это не означает, что все прежние версии Claude одномоментно начали маркировать каждую выдачу.

Anthropic сообщает, что новые модели, выпущенные 2 августа или позже, поддерживают маркировку с момента запуска. Для уже существовавших систем внедрение продолжается. Европейские правила предусматривают для таких систем ограниченный переходный период до 2 декабря в части машинно-читаемой маркировки.

Текстовый watermark, по описанию компании, формируется на уровне модели. Он не должен менять смысл, качество или читаемость ответа. Поскольку сигнал является частью текстового выхода, он может переноситься при копировании и вставке и сохраняться после некоторых правок.

При этом технический механизм Anthropic пока не раскрыла. Поэтому нельзя утверждать, что речь идет, например, лишь о наборе невидимых Unicode-символов. Компания также еще готовит документацию и средства, которые позволят сторонним сервисам распознавать ее метку.

С научно-технической точки зрения ключевой вопрос — устойчивость сигнала. Текст легко трансформировать: перевести, существенно перефразировать, переставить предложения, смешать с фрагментами другого происхождения. Anthropic признает, что такие операции могут осложнить обнаружение watermark.

Отсюда следует важное ограничение: отсутствие найденной метки не доказывает человеческое происхождение. Сигнал мог отсутствовать изначально, но мог и исчезнуть после переработки. Положительное обнаружение тоже нельзя напрямую переводить в утверждение «этот текст написал Claude»: модель могла лишь перевести или отредактировать человеческий материал.

Для файлов применяется другой подход. В поддерживаемых форматах Anthropic планирует использовать цифрово подписанные provenance-метаданные, а для поддерживаемых медиа — C2PA. Этот стандарт позволяет хранить криптографически проверяемые заявления об источнике цифрового актива и его истории.

Криптографическая проверяемость не делает метаданные неуязвимыми. Они могут быть отделены от файла или удалены при конвертации и обработке. И они не подтверждают истинность содержания: provenance отвечает на вопрос о происхождении, но не определяет, соответствует ли изображение или текст реальности.

Anthropic заявляет, что поддерживаемая маркировка будет применяться глобально — в разных продуктах Claude, через API и поддерживаемые облачные каналы. Таким образом, европейское регулирование формирует технологическое поведение продукта за пределами ЕС.

Полноценная оценка системы станет возможна после появления сторонних детекторов. Тогда можно будет измерить устойчивость к редактированию, переводу и смешиванию текста, а также частоту неоднозначных результатов. До этого новый watermark разумнее рассматривать как дополнительный сигнал происхождения, а не как готовый научный тест на авторство.

Вера Ершова

Автор

Репортер

Вера Ершова работает с темами общества, политики, экономики и ежедневных новостей. В редакции Пладром отвечает за проверку фактов, контекст и понятное объяснение событий для читателей.