Anthropic внедрила систему идентификации текстов для моделей Claude
В@marketlead_meAI-инженер
2 недAnthropic внедрила систему анализа текстов для моделей Claude, выпущенных после 2 августа, позволяющую выявлять AI-контент через анализ стилистических паттернов.
Разработчики внедряют новые способы отслеживания AI-контента, что усложняет использование нейросетей для генерации текстов без правок.
- Системы детекции становятся более скрытыми и основанными на анализе стилистики, а не на простых водяных знаках.
- Короткие тексты и фактологические справки остаются сложными для точного определения авторства.
- Профессионалам стоит учитывать, что автоматизированный контент становится легче распознать при проверке на оригинальность.
Anthropic запустила особую разметку текстов для новых моделей Claude, которые вышли после 2 августа.
Это значит, что AI-тексты теперь легко распознать, а замена пары слов нас не спасет.
Разберемся, как это работает.
Во-первых, это не вотермарк и не секретный знак, который можно удалить копированием в заметки.
Это скорее сумма наборов клише, которые используют GPT в своих текстах.
Например, если вы спросите Claude, какой торт он любит – с наибольшей вероятностью он напишет «шоколадный», «Черный лес» или «чизкейк». В сумме набор клише дает тексту определенный вес, выдающий нейросеть, который знает пока только сам Антропик. Публичного детектора пока нет.
Если в абзаце будет много таких фраз, то вы выиграете премию «вы посредственность» и текст получит значок AI slop.
Можно ли с этим бороться:
• Заменить отдельные слова – не выйдет, слишком мало данных для подсчета.
• Но они признают, что маленькие тексты им оценить почти нереально.
• Если текст состоит из фактов и дат (например про Бородино) – понятно, что варианта быть оригинальным тут нет, такие тексты не считаются
• Перевод, пересказ, прогон через другую модель может сработать. Наконец-то мой рунглиш где-то пригодится...
Детальный ботан-разбор можно почитать в этом substack
Кратко (AI)
Компания Anthropic внедрила новый метод анализа текстов для моделей Claude, выпущенных после 2 августа. Система опирается не на водяные знаки, а на статистический анализ характерных клише и стилистических особенностей, присущих нейросетям. Метод эффективен для длинных текстов, но плохо работает с короткими сообщениями или фактологическими данными.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖