Яндекс.Метрика
← Дайджест от 7 августа 2026

Databricks урезала свои расходы на ИИ-программирование до 90% в части сценариев

Внутреннее использование ИИ-агентов для кода в Databricks росло, вместе с ним рос и счёт за токены. Компания опубликовала разбор того, из чего собралась экономия — до 90% в отдельных сценариях при растущем использовании.

Около половины дал перевод настроек по умолчанию на более дешёвые и эффективные модели. Примерно 30% — маршрутизация: простые запросы уходят слабой модели, сложные попадают к сильной. Ещё по десятой части дали показ сотрудникам их собственных трат с гибкими лимитами и чистка разросшегося контекста вместе с настройкой обвязки.

Вывод компании: выигрывает не флагманская модель, а сочетание маршрутизации, обвязки и бюджета. На её внутреннем бенчмарке по соотношению цены и качества рядом стоят GLM 5.2, Opus 4.8 и GPT-5.6 Sol, причём переход с Opus 4.8 на версию 5.0 давал ухудшение по стоимости.

Что говорят
lubujacksonHacker News
Это очевидные твики в духе «переехали на более дешёвый хостинг». Настоящая экономия — в аккуратном управлении контекстом у программных агентов, в грамотной работе с инструментами, чтобы не было холостых циклов, в переводе рабочих процессов в детерминированные, и главное — в ограничениях для нетехнических пользователей, которые жгут токены запросами вроде «проанализируй все документы и дай мне сводку».
bisonbearHacker News
Весь подход держится на возможности оценивать кодинг-агентов на своём коде через доменные эвалы. Только тогда можно доверять логике маршрутизации; без данных о качестве работы агентов это ставка ради экономии денег за счёт продуктивности разработчиков.
bogotaHacker News
Серьёзно? Потому что мы выпилили Databricks и сэкономили больше 2 миллионов в год, ещё и обработку ускорили. Их модель перевыставления затрат — в лучшем случае хищническая.