Агент NVIDIA переписал код вокруг другого агента и срезал счёт за API на треть
Исследователи NVIDIA, MIT и NTU поручили одному ИИ-агенту улучшать харнес другого — код вокруг модели: как формулируется задача, какие инструменты доступны, как разбирается ответ. Модель при этом не меняли.
Агент-оптимизатор перебрал 152 идеи. Четыре из них сократили расход токенов почти вдвое, счёт за API упал примерно на треть. Платой стало качество: средний балл на наборе задач EdgeBench снизился на 6%.
Подопытным был кодинг-ассистент на базе открытого набора Pi. Вывод работы в том, что заметная доля расходов на агента сидит не в модели, а в обвязке вокруг неё — и её можно переписать автоматически.