Anthropic внедряет обязательную маркировку ИИ-контента в ЕС
S@serge_aiAI-инженер
2 недAnthropic начинает маркировать контент Claude в ЕС согласно законам Евросоюза. Разбираем, как работают водяные знаки и почему это не панацея.
Интернет становится прозрачнее: теперь ИИ-контент будет сложнее выдать за человеческий.
- Пользователи в ЕС увидят больше меток «сгенерировано ИИ» на контенте от Claude.
- Маркировка помогает бороться с опасными фейками, например, медицинскими советами от нейросетей.
- Технология пока несовершенна: метки можно случайно удалить, а обычное редактирование текста может привести к ложному срабатыванию системы.
🤨Свершилось. Метки в тексте о ИИ-авторстве. Чуть разберёмся?
Для начала, пока я ломал себе ноги о камни и потом лечил отёкшие лодыжки, в ЕС начал работу закон о том, что нужно маркировать ИИ контент. Не делаем — штрафы сами понимаете каких размеров и в какой валюте. Это краткая сводка большого контекста... Поэтому сейчас оперативно чиню ии-звонарей, чтобы они представлялись в первые 2 секунды, что это ИИ (у кого есть подобные — рекомендую тоже озаботиться).
Так вот — Anthropic рассказывают, что теперь модели Claude запущенные в ЕС со 2.08 должны с первого дня маркировать сгенеренный контекст. В текст будт вшиваться незаметный водяной знак. При обычной копипасте он сохраняется и даже может сохраниться после нескольких правок.
Файлы вроде PNG, JPG и SVG там, где это поддерживается, получат подписанные метаданные происхождения по открытому стандарту C2PA. Маркировку обещают использовать во всех продуктах Claude, у облачных партнеров и во всех доступных регионах.
Звучит как долгожданный детектор нейросетевого авторства, но по факту — это больше похоже на след контакта именно с Claude. К подобным маркировкам уже разные платформы прикрутили свои бейджики. Они есть и в ютубе, и в других соцсетках... Но пока что они ставятся рандомно — где-то автором, где-то системой самостоятельно. И это всё ещё даёт "контент-заводчанам" пространство для мимикрирования под живых людей...К сожалению... Но в будущем скорее всего системы на 100% будут трекать ИИ контент, что-то типа content id будет.
А этот переходной этап от дикого запада к порядку — он болезненный и не всегда понятный. Вот я о чём подумал.Возьмём простой кейс — вы сами написали текст, а Claude только поправил запятые или перевел его. Итоговый материал уже может получить метку, хотя идеи и исходный текст принадлежат вам. То же касается пересказа и конвертации файлов и многих других продуктов модели — везде могут быть метки, хотя вы просто отредачили орфографию.
В обратную сторону система тоже походу не работает. Если метки нет — это не доказывает человеческое происхождение. Ее могут разрушить сильная редактура, перефразирование, перевод или смешивание с другим текстом и всякие другие танцы с бубнами (уникализаторы уже все кому надо научились кодить).. Метаданные (это такие скрытые характеристики, если вы не в курсе) файла легко потерять при пересохранении, смене формата, создании скриншота, прогоне через уникализатор и т.д и т.п.
Здесь пришлось удалить несколько абзацев своих мыслей от горения задницы на тему нейрослопа. И просто оставлю, что лично я за все эти маркировочки а иногда и ОГРОМНЫМИ БУКВАМИ. Старшее поколение смотрит ИИ контент в таааааких количествах (у меня есть стата на руках), что капец. И И меня в этом особенно смущает, когда это контент потенциально опасный для жизни (фейкуют под живых врачей и раздают советы направо и налево в ютубе по типу садиться на огурец от геморроя)...
Короче консервативный ЕС хоть и замедляет прогресс, хоть и сам себе стреляет раз в день в каждую из коленных чашечек, но кто-то же должен тормозить откровенное безумие. Есть вероятность что за Anthropic подтянуться и другие компании.
И кто знает, может интернет и не умрёт...
ссылка на статью от anthropic (как они это реализовуют)

КонтекстAI
В ЕС вступил в силу AI Act, который обязывает разработчиков и пользователей маркировать контент, созданный искусственным интеллектом, для борьбы с дезинформацией и фейками. Anthropic адаптирует свои продукты под эти требования, используя водяные знаки и стандарт C2PA.
Кратко (AI)
Компания Anthropic начала внедрять обязательную маркировку ИИ-контента для пользователей в ЕС, следуя новым европейским нормам. В текст и метаданные файлов добавляются скрытые водяные знаки, однако автор отмечает, что их легко удалить, а сама система может ошибочно помечать контент, лишь частично отредактированный нейросетью.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖