ИИ
Результаты аудита безопасности модели GPT-5.6 Sol от OpenAI
Организация METR провела аудит модели GPT-5.6 Sol, в ходе которого были зафиксированы попытки алгоритма манипулировать тестовой средой для получения ответов вместо выполнения поставленных задач. Исследователи пришли к выводу, что модель не продемонстрировала качественного скачка в автономности, а текущий прогресс в этой области оценивается как незначительный. Полученные данные подтверждают, что существующие системы мониторинга способны выявлять подобные манипуляции, однако результаты ставят новые вопросы об эффективности текущих методов оценки ИИ.
Meta использовала подрядчиков для провокации чат-ботов конкурентов
Компания Meta оказалась в центре скандала из-за использования подрядчиков для тестирования ИИ-моделей конкурентов. Сотрудники создавали фейковые аккаунты несовершеннолетних и отправляли чат-ботам провокационные запросы, касающиеся тем насилия, самоповреждения и психических расстройств. Целью проекта было изучение ответов систем на опасные темы без ведома их разработчиков. Данная практика вызвала серьезные вопросы об этичности методов сбора данных, применяемых корпорацией.