Перекупы маскируют билеты на концерт Канье Уэста на Авито




Французский стартап Mistral 4 августа выпустил Shieldstrali — мультимодальный классификатор безопасности контента на 3 млрд параметров с открытыми весами. В отличие от обычных guardrail-моделей (типа Llama Guard), где таксономия вреда зашита прямо в веса и для смены категорий нужен дообучение, Shieldstral переносит политику модерации в системный промпт: критерии задаются текстом, а не переобучением.
Модель не генерирует текст, а работает как бинарный классификатор да/нет по заданному вопросу, что делает её быстрой и универсальной — один и тот же чекпоинт можно использовать и для детского приложения, и для пентест-инструмента, просто переписав вопрос.
Reddit расширил тестирование ИИ-инструмента для модерации контента. Доступ к нему получили все новые сабреддиты, использование пока добровольное.
В перспективе новая система может заменить действующий Automoderatori, который выявляет нарушения только по точным ключевым словам и шаблонам — то есть ИИ-модерация должна работать точнее и гибче.
LinkedIn ввёл новую опцию модерации: теперь на предложенные посты в ленте можно пожаловаться с формулировкой «Seems like AI slopi» («похоже на ИИ-слопi»). Цель — снизить долю «неаутентичного» контента, сгенерированного нейросетями, которым, по оценке авторов постов, забита буквально каждая вторая публикация.
Одновременно, по данным vc.ru, LinkedIn отказался от функции «улучшения» публикаций, которая ранее переписывала текст пользователя с помощью ИИ — то есть платформа одной рукой борется со слопом, а другой ранее сама предлагала его создавать.
В ночь на 4 августа 2026 года Apple без предупреждения удалила Telegram из App Storei по всему миру — приложение стало недоступно для скачивания во всех регионах. Причиной, по заявлению Apple, стало обнаружение в мессенджере материалов сексуального насилия над детьми. Разработчики Telegram удалили запрещённый контент и заблокировали нарушителя, после чего примерно через полтора часа приложение вернули в магазин.
Инцидент вскрыл схему вымогательства владельцев Telegram-сообществ: злоумышленники прячут запрещённый контент в отредактированных старых сообщениях публичных групп и жалуются напрямую в Apple, угрожая блокировкой приложения. Основатель Telegram Павел Дуров* назвал произошедшее «потенциальным системным риском» для любого сервиса с пользовательским контентом.
С мая 2026 года система ИИ-модерации Discord по ошибке заблокировала свыше 8000 аккаунтов. Алгоритм принимал любые изображения с сеткой — скриншоты Excel-таблиц, шахматные доски, инвентарь из Minecraft и UV-текстурыi — за запрещённый контент.
Discord признал баг и заявил, что исправил проблему, однако пользователи продолжают сообщать о похожих блокировках. Затронутые аккаунты сейчас восстанавливают.
Это всё на сейчас.