← к ленте

Anthropic внедрила систему идентификации текстов для моделей Claude

В@marketlead_meAI-инженер
2 нед

Anthropic внедрила систему анализа текстов для моделей Claude, выпущенных после 2 августа, позволяющую выявлять AI-контент через анализ стилистических паттернов.

Разработчики внедряют новые способы отслеживания AI-контента, что усложняет использование нейросетей для генерации текстов без правок.

  • Системы детекции становятся более скрытыми и основанными на анализе стилистики, а не на простых водяных знаках.
  • Короткие тексты и фактологические справки остаются сложными для точного определения авторства.
  • Профессионалам стоит учитывать, что автоматизированный контент становится легче распознать при проверке на оригинальность.
Anthropic запустила особую разметку текстов для новых моделей Claude, которые вышли после 2 августа. Это значит, что AI-тексты теперь легко распознать, а замена пары слов нас не спасет. Разберемся, как это работает. Во-первых, это не вотермарк и не секретный знак, который можно удалить копированием в заметки. Это скорее сумма наборов клише, которые используют GPT в своих текстах. Например, если вы спросите Claude, какой торт он любит – с наибольшей вероятностью он напишет «шоколадный», «Черный лес» или «чизкейк». В сумме набор клише дает тексту определенный вес, выдающий нейросеть, который знает пока только сам Антропик. Публичного детектора пока нет. Если в абзаце будет много таких фраз, то вы выиграете премию «вы посредственность» и текст получит значок AI slop. Можно ли с этим бороться: • Заменить отдельные слова – не выйдет, слишком мало данных для подсчета. • Но они признают, что маленькие тексты им оценить почти нереально. • Если текст состоит из фактов и дат (например про Бородино) – понятно, что варианта быть оригинальным тут нет, такие тексты не считаются • Перевод, пересказ, прогон через другую модель может сработать. Наконец-то мой рунглиш где-то пригодится... Детальный ботан-разбор можно почитать в этом substack

Кратко (AI)

Компания Anthropic внедрила новый метод анализа текстов для моделей Claude, выпущенных после 2 августа. Система опирается не на водяные знаки, а на статистический анализ характерных клише и стилистических особенностей, присущих нейросетям. Метод эффективен для длинных текстов, но плохо работает с короткими сообщениями или фактологическими данными.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖