TGViewer
Data Secrets Data Secrets @data_secrets · 94.2K subscribers
Post #9691 23.7K
Теперь Anthropic будет метить весь сгенерированный текст. Разбираемся, как это работает.

Стартап подписал Кодекс поведения по прозрачности ИИ-контента в рамках Европейского AI Act. Он вступил в силу 2 августа, и с этого момента провайдеры и деплоеры ИИ-систем, которые выходят в ЕС, обязаны встраивать водяные знаки в сгенерированный текст и файлы.

Собственно, антропики только что обновили документацию по этому поводу: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content.

Несмотря на то, что это закон ЕС, маркировка будет применяться глобально. Однако это не значит, что прямо с сегодняшнего дня весь ваш текст от моделей Claude будет помечен.

Во-первых, поддерживать маркировку сразу с запуска должны только модели, которые вышли после 2 августа. Для остальных моделей закон предусматривает переходный период в 4 месяца, и у Anthropic старые модели тоже пока остаются без вотерок (в документации написано, что они "работают над добавлением фичи", но сроков нет).

Во-вторых, пока что маркировку не сможет прочитать вообще никто, кроме самих антропиков. Пока что не существует общедоступного инструмента, в который можно вставить текст с вотермаркой и получить ответ типа "да, это Claude" или "нет, не Claude". Стартап обещает выпустить такие инструменты и документацию, но сроков, опять же, нет. Так что еще какое-то время эти метки будут чистой формальностью.

В-третьих, эти метки исчезают, если текст немного отредактировать. Тут надо понимать, как вотермарка в принципе прячется в тексте. На каждом шаге генерации модель по секретному ключу и предыдущим токенам делит словарь на "предпочтительные" и обычные токены, и слегка склоняется в сторону первых там, где это не портит текст. В результате в тексте накапливается статистический паттерн, невидимый на глаз. Детектор с тем же ключом проверяет текст на этот паттерн и по частоте совпадений судит, сгенерирован ли он моделью. Поэтому если вы подредактируете текст, смешаете его с другим текстом, или он, например, будет коротким, статистический паттерн перестанет быть надежно обнаружимым.

(Для файлов это работает немного иначе: там просто встраиваются соответствующие C2PA-метаданные).

Честно говоря, большого смысла в таких пометках пока не видно. Технически интересно, юридически обязательно, но как решение исходной проблемы – довольно дыряво.
  • 😁 123
  • ❤ 36
  • 🫡 32
  • 😭 14
  • 🤯 7
  • 👍 6
  • 🔥 4
  • 🏆 3
  • 🤝 2
  • 💯 1
More from @data_secrets
  1. Sep 28, 2026🦾 Практический RecSys: собери рекомендательную ленту с помощью ML — на бесплатном вебинар…
  2. Sep 28, 2026Все настолько любят ресеты от Тибо, что даже 6 точек от него набирают миллионы просмотров…
  3. Sep 28, 2026В Твиттере заметили, что Андрей Карпаты ничего не постит уже 2 месяца, хотя раньше делал э…
  4. Sep 28, 2026Дженсен Хуанг и 100+ партнеров анонсируют NVIDIA Open Agent Safety Platform Это система дл…
  5. Sep 28, 2026Тот самый курс по ML, который прошли 200 000 человек. Теперь — в новой версии С 2016 по 20…
  6. Sep 28, 2026OpenAI: заявляют, что замедляют обучение и массово перебрасывают человеческие ресурсы на б…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →