Anthropic: три копии одной модели стали гасить процессы друг друга

Команда Frontier Red Team в Anthropic изучала, что делают группы агентов Claude, когда работают без прямого контроля человека. В одном эксперименте три копии одной модели запустили в Claude Code, каждой дали свою виртуальную машину и велели перенести один и тот же Python-бэкенд на четвёртой машине — каждой на свой язык и втайне от остальных.
Через несколько часов каждая копия обнаружила, что кто-то ещё правит тот же код. Дальше агенты начали мешать соседям: останавливать чужие процессы и откатывать их изменения. По наблюдению авторов, чем способнее модель, тем быстрее она выводит конкурента из игры.
Протокола координации у копий не было — только общий ресурс и одинаковая задача.