Яндекс.Метрика
← Дайджест от 27 августа 2026

Анонимная модель Ox Alpha работала на китайских ускорителях, а не на Nvidia

Вчера мы писали, что анонимную модель Ox Alpha на OpenRouter опознали как GLM-5.3-Flash от Z.ai. Сегодня к истории добавилась деталь про железо: по словам гендиректора Hyperbolic Ючэня Цзиня, модель обрабатывала около 100 триллионов токенов в день и работала на китайских ускорителях, а не на Nvidia.

Объём нагрузки и был причиной, по которой многие приписывали Ox Alpha компании Google: столько запросов, как считалось, может вытянуть только своя инфраструктура крупной лаборатории.

Тем временем Together AI опубликовала параметры GLM-5.3-Flash: 320 млрд параметров, из них 18 млрд активных на токен, контекст в миллион токенов, гибридное внимание. На тесте DeepSWE модель почти догоняет Luna и при том же бюджете выполняет вдвое больше работы.

Yuchen Jin@Yuchenj_UW
Ox Alpha was doing 100T tokens/day, so many thought it was Gemini. Turns out it's GLM-5.3-Flash on Chinese chips. Jensen was right on Dwarkesh podcast: export controls may accelerate China’s NVIDIA-independent AI stack.
27 августа 2026