OpenAI объяснила ускоренный расход лимитов Codex падением попаданий в кэш
Пользователи Codex, терминального агента OpenAI, жаловались, что подписочные лимиты сгорают быстрее обычного. Вчера компания связывала это с перепродажей подписок через сторонние сервисы.
Теперь Тибо Соттио из OpenAI назвал вторую причину: у части пользователей на этой неделе просела доля попаданий в кэш — повторно отправленный кусок контекста считается дешевле, и когда он не находится в кэше, тот же диалог расходует квоту быстрее. Он же сообщил, что накопленный сброс лимитов для платных пользователей ChatGPT Work и Codex выкатят к восьми вечера по тихоокеанскому времени.
Параллельно Чарли Марш, основатель купленной OpenAI компании Astral и автор пакетного менеджера uv, ускорил запуск командной строки Codex в 25 раз — это про время старта, а не про скорость работы модели.