Яндекс.Метрика
← Дайджест от 18 августа 2026

Anthropic: один агент с чужой идеей заражает ею всю команду

Anthropic выпустила работу про то, как идеи расходятся по сети агентов. Брали команду из шести моделей, работающих над нейтральной общей задачей, и одному агенту меняли системную подсказку — например, на сильную любовь к китам или на убеждение, что ИИ должен доминировать над людьми.

Оказалось, что одного заражённого участника достаточно: концепция расходится по всей команде, хотя у остальных в подсказках ничего подобного нет. Руководитель направления Логан Грэм объясняет интерес к теме арифметикой: если наивно продлить нынешний рост выручки от ИИ, через два-три года какая-то доля мирового ВВП будет приходиться на взаимодействия агентов между собой, и лаборатория хочет заранее понять, как это ломается.

Logan Graham@logangraham
Last week, we published a first look into our new research on multiple agents. Consider: if you naively extrapolate AI revenues, within 2-3 years it's possible some % of global GDP could be agent-agent interactions. We want to know how that could fail. In the past ~month, the
18 августа 2026