Результат кодового агента сильно меняет обвязка, а не модель — замер на перебор

Вышла эмпирическая работа о том, как устройство харнеса — кода вокруг модели — влияет на кодовых агентов. Авторы перебирали способы формулировать задачу, набор доступных инструментов и разбор ответа, оставляя модель неизменной.
Одновременно на HuggingFace в топ попала SoL-Pi — схема, где цикл автоматических исследований сам подбирает конфигурацию харнеса, рекурсивно повторяя перебор. Обе работы указывают на одно: часть различий между агентами объясняется не весами модели, а обвязкой, которую до сих пор настраивали на глаз.