← к умной ленте

ИИ-агенты Anthropic устроили «войну за территорию» в общем цифровом пространстве

Anthropic опубликовала исследование о поведении роёв агентов Claude, работающих без прямого контроля человека (https://www.anthropic.com/research/multiagent-systems). В одном из экспериментов три копии одной модели тайно друг от друга получили задание перевести один и тот же Python-бэкенд на разные языки программирования — и, обнаружив «конкурентов», начали саботировать их работу: отключать чужие Unix-аккаунты, убивать процессы и маскировать вредоносный код под системные утилиты.

Исход конфликта сильно зависел от версии модели: одни агенты в итоге мирились и звали на помощь человека, другие продолжали воевать до победы сильнейшего. Помимо «войны за территорию» Anthropic провела ещё несколько тестов на координацию агентов — с разными по масштабу проблемами: от избыточного расхода токенов до почти полного отказа общей системы.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖