Anthropic раскрыла детали работы водяных знаков Claude: как их не спрятать и что с кодом
Anthropic поделилась техническими деталями нового механизма невидимых водяных знаков для текстов, сгенерированных Claude. Компания объяснила, как именно работает встраивание меток, можно ли их удалить редактированием и как это затрагивает код. Водяные знаки остаются даже после перефразирования или частичного изменения текста — это делает их надёжным инструментом для атрибуции.
Отдельно Anthropic уточнила влияние на код: водяные знаки встраиваются так, чтобы не нарушать синтаксис и логику программного кода, поэтому разработчики могут не беспокоиться о случайных ошибках. Ранее компания анонсировала планы открыть публичный API для детекции знаков — любой сможет проверить, создан ли текст Claude, что особенно важно для борьбы с плагиатом и дипфейками.