Яндекс.Метрика
← Дайджест от 29 июля 2026

OpenAI применила GPT-5.6 Sol к своим серверам: работа моделей подешевела на 20%

OpenAI поручила своей же модели GPT-5.6 Sol оптимизировать инфраструктуру, на которой та работает. Модель переписывала низкоуровневый код для видеокарт и дорабатывала спекулятивное декодирование — приём, когда маленькая быстрая модель предугадывает следующие слова, а большая проверяет их пачкой.

По словам компании, обслуживание запросов подешевело на 20%, а скорость выдачи текста выросла больше чем на 15%. Проверить эти цифры извне нечем, но это редкий случай, когда «ИИ улучшает ИИ» подтверждают счётом за электричество, а не демонстрацией.

OpenAI@OpenAI
After deployment, we applied GPT-5.6 Sol to advance the frontier of efficiency by making itself more efficient to run. The results: - 20% lower serving costs from production GPU kernel improvements. - 15%+ better token-generation efficiency from improved speculative decoding.
13 537
29 июля 2026