Яндекс.Метрика
← Дайджест от 31 августа 2026

Google и Tencent предложили, как избавить агента от растущей истории диалога

Управление контекстом агента выделилось в отдельное направление исследований — вышли сразу две работы. Google с соавторами предложила SKILL.state: вместо растущей истории диалога агент ведёт явное изменяемое состояние и постоянную базу навыков. Заявленный результат — выше точность на длинных задачах при меньшем суммарном расходе токенов.

Tencent представила ContextPilot, где агента учат самому редактировать свой рабочий контекст, а награду при обучении начисляют за конкретные правки, а не за исход задачи целиком. Обе работы бьют в одну проблему: на длинной дистанции агент тонет в собственной переписке.

DAIR.AI@dair_ai
Great paper from Google and colleagues. It proposes an interesting approach to improve agents on long-horizon tasks. Long-running agents slow down and start poisoning their own context. Both symptoms come from the same design choice, which is keeping execution alive by https://t.co/gtPThVBz49
31 августа 2026