Яндекс.Метрика
← Дайджест от 19 сентября 2026

Разработчик подключил локальную Gemma к Codex ради экономии — расход вырос вдвое

Автор на Хабре подключил локальную Gemma к Codex, чтобы экономить облачный лимит, и получил обратный результат: на простой задаче расход вырос вдвое. Железо — MacBook Pro 2019 года с шестиядерным Core i7 и 16 ГБ памяти. Модели — gemma3:4b и gemma2:2b через Ollama.

Замысел был отдавать мелочь локальной модели: разбор короткого стека ошибки, сводку лога, текст коммита. На практике облачный Codex тратил токены на постановку задачи локальной модели и разбор её ответа, а результат приходилось переделывать — суммарный расход оказался вдвое выше, чем если бы Codex сделал всё сам.