OpenAI применила GPT-5.6 Sol к своим серверам: работа моделей подешевела на 20%
OpenAI поручила своей же модели GPT-5.6 Sol оптимизировать инфраструктуру, на которой та работает. Модель переписывала низкоуровневый код для видеокарт и дорабатывала спекулятивное декодирование — приём, когда маленькая быстрая модель предугадывает следующие слова, а большая проверяет их пачкой.
По словам компании, обслуживание запросов подешевело на 20%, а скорость выдачи текста выросла больше чем на 15%. Проверить эти цифры извне нечем, но это редкий случай, когда «ИИ улучшает ИИ» подтверждают счётом за электричество, а не демонстрацией.
OpenAI@OpenAI
After deployment, we applied GPT-5.6 Sol to advance the frontier of efficiency by making itself more efficient to run. The results: - 20% lower serving costs from production GPU kernel improvements. - 15%+ better token-generation efficiency from improved speculative decoding.
13 537 ♡
29 июля 2026Что говорят
jj⚙️🌳🔭🔬@murchiston
Сделайте, пожалуйста, отдельный тариф с доступом к «неоптимизированным» моделям — без спекулятивного декодирования и прочих фокусов со скрытым урезанием. Пусть лимиты будут ниже и цена выше, мне всё равно: просто сделайте хоть что-то для тех, кому качество важнее скорости и стоимости.
3 ♡
xlr8harder@xlr8harder
Если спекулятивное декодирование реализовано корректно, оно не меняет распределение выходов. В чём именно ваше беспокойство?
3 ♡