Anthropic сообщила, что будущие версии Claude будут добавлять в сгенерированный текст статистический водяной знак. Компания связывает изменение с требованиями европейского регулирования и общей задачей прозрачности AI-контента.
Как работает маркировка
Речь не о невидимых символах и не о метке, которую можно найти простым поиском в файле. При генерации модель выбирает слова из нескольких равноправных вариантов так, чтобы в достаточно длинном тексте возникал узнаваемый статистический рисунок.
Для читателя фраза должна выглядеть обычно. Проверяющий инструмент, у которого есть ключ, оценивает сочетание выборов и сообщает вероятность того, что в создании текста участвовал Claude.
Маркировка не содержит идентификатор пользователя, компании или конкретного диалога. Она отвечает только на ограниченный вопрос о возможном участии модели.
Что водяной знак не решает
Anthropic не представляет технологию как универсальный детектор. Сигнал слабее в коротких и строго фактических ответах, где у модели мало свободы выбора слов. Сильное редактирование или смешивание текста с человеческим материалом тоже может снизить точность.
Для кода и других случаев, где важен точный вывод, маркировка применяться не будет. Кроме того, вероятностный результат нельзя использовать как единственное доказательство нарушения или обмана.
Практический смысл
Для редакций и компаний это дополнительный сигнал происхождения, но не замена внутренним правилам. Надёжнее сохранять историю подготовки материала, источники, версию модели и факт человеческой проверки.
Водяной знак может помочь при массовом анализе контента. Для решения по одному конкретному тексту по-прежнему нужен контекст и несколько независимых признаков.
