← к ленте

Атака PromptSpy: как фишинг обманывает ИИ-ассистентов

C@cyberyozh_officialAI-инженер
2 нед

Исследователи Forcepoint показали, как скрытые инструкции в письмах заставляют ИИ-ассистентов игнорировать угрозы и помогать хакерам.

Это меняет правила безопасности для всех, кто использует ИИ для обработки почты.

  • Злоумышленники могут использовать скрытый текст для управления ИИ-помощниками.
  • ИИ может ошибочно пометить фишинговое письмо как доверенное.
  • Автоматизированные цепочки ИИ-агентов становятся уязвимыми к цепным атакам.
💀Как атака PromptSpy обманывает нейросети прямо в вашей почте Фишинговые письма больше не пытаются усыпить бдительность человека - им это просто не нужно. Зачем тратить силы на изощренную социальную инженерию, если за пользователя почту читает и сортирует ИИ-ассистент? 🔍Исследователи из Forcepoint продемонстрировали симуляцию атаки PromptSpy, которая показывает, как переманить нейросеть-помощника на сторону хакеров. 🟢Суть метода строится на разнице между тем, что видит человек на экране, и тем, что считывает модель из исходного кода:
🟦Человек видит: Совершенно безобидное и вежливое приглашение на конференцию.
🟦ИИ-ассистент получает: Скрытую директиву, зашитую в письмо через невидимый белый текст, HTML-блоки с display:none, скрытые Unicode-символы или фальшивые служебные разделители ролей.
В итоге скрытый промпт приказывает ИИ-помощнику проигнорировать инструкции безопасности, снять метку "подозрительно", пометить отправителя как доверенного и выдать человеку сводку с призывом обязательно перейти по фишинговой ссылке. Самый высокий риск возникает в связках из нескольких ИИ-агентов, где один компонент читает почту, второй создает задачи в календаре, а третий генерирует черновики ответов. Одна зараженная строчка в входящем письме запускает эффект домино по всей цепочке автоматизации. 🦔 CyberYozh

Кратко (AI)

Исследователи из Forcepoint представили метод атаки PromptSpy, позволяющий злоумышленникам внедрять скрытые инструкции в электронные письма. Эти команды, невидимые для человека, заставляют ИИ-ассистентов игнорировать фильтры безопасности и способствовать фишингу.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖