← к ленте

Anthropic, OpenAI и Google внедряют невидимые водяные знаки для ИИ-контента

Р@niketasfmAI-инженер
2 нед

Разбор внедрения ИИ-вотермарок в соответствии со статьей 50 европейского AI Act: как это работает, кто подписал кодекс и почему детекторы пока неэффективны.

Внедрение невидимых меток меняет правила игры для проверки подлинности контента в интернете.

  • Разработчики ИИ обязаны внедрять машиночитаемую маркировку контента.
  • Публичные детекторы ИИ-текста пока не работают надежно, что затрудняет проверку.
  • Маркировка поможет поисковым системам и платформам фильтровать сгенерированный «шум» от контента реальных людей.
Anthropic, OpenAI и Google будут помечать создаваемые тексты невидимыми ИИ-вотермарками Статья 50 европейского AI Act вступила в силу. Провайдеров обязали помечать ИИ-генерации — но самому проверить эти метки пока нельзя. 10 августа Anthropic обновила справочную статью о том, как Claude помечает сгенерированный контент. В текст теперь будут вплетать незаметные водяные знаки — это происходит на уровне модели, поэтому он переживает копипаст, правки и не зависит от того, откуда текст пришёл: чат, API, Claude Code, Cowork, неважно. К сгенерированным файлам и изображениям (например, .png, .jpg, .svg) прикручиваются метаданные по стандарту C2PA. Это будут делать «все модели Claude, запущенные 2 августа 2026 года и позже» — текущие модели пока нет, для них обозначен некий «переходный период» без конкретных сроков. Очевидно, тайминг говорит, что это сделано для соответствия европейскому AI Act, но вотермарк будет добавляться везде, где Claude доступен, а не только в ЕС. Кого и к чему обязали Статья 50 AI Act — та часть закона 2024 года, которая применяется со 2 августа 2026. Она требует от провайдеров генеративного ИИ, чтобы выдача была помечена машиночитаемо и достоверно определялась как синтетическая, а от тех, кто её публикует, — раскрывать дипфейки и сгенерированные тексты на общественно значимые темы. Под это Еврокомиссия выкатила кодекс практик из двух секций: первая для провайдеров, вторая для деплойеров. Подписание кодекса добровольное, а обязательства исполнять — принудительные: за несоблюдение статьи 50 грозит штраф до €15 млн или 3% от глобального оборота. К концу июля подписались около 190 организаций. В секции провайдеров — Google, Microsoft, OpenAI, Anthropic, Mistral и Meta (признана в России экстремистской организацией и запрещена). В секции деплойеров — Getty Images, Lufthansa, Bulgari, Lenovo, Iberdrola и десяток греческих новостных сайтов. Ни Google, ни Microsoft, ни Meta там нет. То есть под обязательства помечать ИИ-контент гиганты вписались, а показывать плашку у себя на площадках — пока нет. Естественно, китайских или российских компаний ни в одном из списков нет. Впрочем, как и Apple, Amazon и SpaceX. Настоящего детектора ИИ-текста нет ни у кого Anthropic обещает «в будущей документации» рассказать, как проверять свои метки ИИ-контента, но пока детектора от Claude нет. OpenAI запустила публичный верификатор с API — он ловит только картинки и аудио, текст ChatGPT пока не метит, но обещает начать это делать. Google метит текст Gemini через SynthID с 2024 года, сама технология выложена в опенсорс, а детектор раздают лишь избранным медиа и исследователям. Сторонние детекторы вроде GPTZero работают недостоверно: они ищут в тексте тропы — длинные тире, частотные обороты, ритм — и на этом гадают. Я скопипастил в один такой свежую генерацию Gemini — получил «создано человеком, уверенность 68%». Метку придумали не для читателя В кодексе есть исключение: ИИ-текст можно не помечать, если он прошёл человеческую редактуру и кто-то несёт за него ответственность. Логика такая: если юрист подписал заключение, он за него отвечает — неважно, чем он его создавал. Получается, маркировка направлена для проверки, кто за текст отвечает, а ИИ-слоп это или нет. Google — пионер этой движухи, потому что у него бизнес построен на поиске: ему нужно отличать сигнал от шума. Тысяча постов на Reddit от живых людей — сигнал, что тема кого-то волнует, а тысяча сгенерированных постов — просто шум. Плашку «Made with AI» уже автоматически ставят контенту в X. В LinkedIn, где раньше вообще была кнопка генерации ИИ-постов, теперь наоборот есть кнопка «Выглядит как ИИ-слоп». Подробнее про это можно почитать в недавней статье Виталия Вебера. Визуально водяной знак на тексте определить будет нельзя. В видео Google про SynthID подробно показано, как именно это работает: маркировка зашифровывается и считывается по принципу наличия определённых слов, а не каких-то специальных или невидимых символов. Поэтому так просто генерации из текста не удалишь.
КонтекстAI
Статья 50 европейского AI Act — это часть масштабного регулирования ИИ в ЕС, которая вступает в силу 2 августа 2026 года. Она обязывает разработчиков ИИ-моделей маркировать контент как синтетический, чтобы повысить прозрачность и бороться с дезинформацией.

Кратко (AI)

Крупнейшие ИИ-компании начали внедрять невидимые водяные знаки в свои модели для соответствия статье 50 европейского AI Act. Несмотря на обязательства провайдеров, надежных публичных инструментов для проверки таких меток пока не существует, а текущие сторонние детекторы показывают низкую точность.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖