Понять, участвовал ли ИИ в создании текста, становится всё сложнее. Anthropic предлагает решать эту проблему не видимой подписью «написано нейросетью», а незаметной закономерностью внутри самого языка. Будущие модели Claude будут ставить статистический водяной знак. Он не добавляет в материал специальных символов, пробелов или служебных фраз и не меняет его внешний вид.
Принцип основан на выборе слов. Когда у Claude есть несколько одинаково уместных продолжений фразы, система с помощью секретного ключа выбирает одно из них. По отдельности такие решения ничем не отличаются от обычного текста. Но на длинной дистанции они складываются в последовательность, которую сможет обнаружить специальный детектор. Anthropic использует подход SynthID‑Text от Google DeepMind и заявляет, что маркировка не должна ухудшать смысл, читаемость или выразительность ответа.
У технологии есть ограничения. Чем короче текст, тем слабее сигнал. Сложнее найти его и в фрагментах, где формулировка почти не предполагает выбора — например, в точных фактах или программном коде. Небольшая редактура, вероятно, не уничтожит маркер полностью, а глубокий рерайт может его стереть. Метка также не хранит данные о пользователе и не доказывает авторство. Она лишь показывает вероятность существенного участия Claude. Изображения и поддерживаемые файлы компания собирается сопровождать данными о происхождении по стандарту C2PA, а дату запуска собственного инструмента проверки пока не называет.




