Как работает водяной знак в текстах Claude
К@d_codeавтор про «tech»
1 недAnthropic раскрыла механизм работы водяных знаков в текстах Claude: использование статистических закономерностей при выборе слов вместо скрытых символов.
Это меняет способы проверки текстов на ИИ-происхождение.
- Метод не использует скрытые символы, что делает его устойчивым к простому копированию текста.
- Определение авторства ИИ теперь основано на статистическом анализе выбора слов моделью.
- Понимание этого механизма помогает оценить надежность инструментов для детекции ИИ-контента.
🤗 Нейрослопу приходит конец?
Anthropic объяснила, как устроен водяной знак в текстах Claude.
Спойлер: никаких скрытых символов — модель просто чуть иначе выбирает между словами «пасмурно» и «серо», и по этой цепочке потом можно посчитать вероятность, что текст писал ИИ.
Рассказываем подробности и где это не будет работать:
↖️ https://kod.ru/claude-vodyanoy-znak-kak-rabotaet

Кратко (AI)
Компания Anthropic объяснила принцип работы водяных знаков в текстах, генерируемых моделью Claude. Система не использует скрытые символы, а опирается на специфический выбор слов, который позволяет статистически вычислить вероятность того, что текст был создан ИИ.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖