Anthropic выкатили невидимые водяные знаки для всех моделей, запущенных после 2 августа 2026 года (привет новым требованиям EU AI Act). Под капотом — модифицированный метод SynthID-Text от Google DeepMind.
Как это работает? При генерации текста LLM обычно выбирает следующее слово с долей случайности. Теперь этот "рандом" диктуется специальным криптографическим ключом. Образуется уникальный математический паттерн прямо в выборе слов, который нельзя увидеть глазом, но можно распознать через API.
Главное для разработчиков: ваш сгенерированный код в безопасности. Там, где синтаксис требует точного ответа (например,
2+2=4 или специфичный API-вызов), система не вмешивается, чтобы не сломать логику. Водяной знак может проявиться разве что в текстовых комментариях к коду.Как думаете, скоро научатся обходить такую маркировку?
🙈 Да, прогонят текст через другую LLM
😍 Нет, паттерн зашит слишком глубоко
😝 Вообще без разницы
#AI #LLM #GenAI #cybersecurity
Anthropic Blog
