🟦Grok 4.5 оказался на первом месте по возможности обхода цензуры: исследователи нашли 385 способов обхода защиты. Средняя цена автоматического поиска одного готового взлома - смешные $58. 🟦Gemini 3.1 Pro держится чуть лучше ($278 за найденную уязвимость), но всё равно охотно выдает запрещенку при правильном подходе. 🟦Claude Fable 5 и GPT-5.6 Sol показали себя лучше всего - эксперты не смогли найти ни одного универсального способа заставить их сливать опасный контент.🦔 CyberYozh
Первый рейтинг устойчивости нейросетей к джейлбрейкам от Far Ai
C@cyberyozh_officialAI-инженер
2 недОрганизация Far Ai протестировала флагманские ИИ-модели на устойчивость к обходу цензуры. Grok 4.5 оказался самым уязвимым, а Claude Fable 5 и GPT-5.6 Sol — самыми защищенными.
Исследование показывает, что безопасность ИИ-моделей сильно различается, что создает риски для использования нейросетей в чувствительных задачах.
- Разработчики ИИ используют разные подходы к цензуре, что делает одни модели более уязвимыми к злоупотреблениям, чем другие.
- Стоимость обхода защиты популярных моделей оказалась крайне низкой, что упрощает доступ к потенциально опасному контенту.
- Результаты теста помогают компаниям и пользователям выбирать более безопасные инструменты для работы.
💥Рецепт ядерной бомбы за $58: вышел первый рейтинг "взламываемости" нейросетей
Если один алгоритм отказывается делиться инструкциями по созданию оружия или проведению кибератак, злоумышленнику не нужно ломать систему - достаточно просто уйти к конкурентам, у которых цензура обходится за пару баксов.
🔍Организация Far Ai провела первый масштабный тест флагманских моделей на устойчивость к джейлбрейкам:
Кратко (AI)
Организация Far Ai опубликовала результаты исследования устойчивости популярных нейросетей к джейлбрейкам. Выяснилось, что Grok 4.5 и Gemini 3.1 Pro подвержены обходу цензуры, в то время как Claude Fable 5 и GPT-5.6 Sol продемонстрировали высокую степень защиты от генерации опасного контента.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖