OpenAI показала замеры своего чипа Jalapeño против ускорителей Nvidia

Jalapeño — первый собственный чип OpenAI, спроектированный вместе с Broadcom специально под работу уже обученных моделей, а не под обучение. Компания опубликовала первые внутренние замеры: на моделях GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 в сравнении с Nvidia GB200 и GB300 получилось в 1,5–1,9 раза больше производительности на ватт и в 1,7–3,6 раза меньше задержки от запроса до ответа.
На GPT-OSS 120B чип выдал до 1459 токенов в секунду на одного пользователя. Заявленный предел потребления — 700 Вт, в тестах не поднималось выше 550 Вт.
Цифры пока только от самой OpenAI и получены на ранней ревизии кремния; независимых прогонов нет, развёртывание в своих датацентрах компания только планирует. Разбор SemiAnalysis собрал 358 очков на Hacker News, где спорят, насколько сопоставимы условия тестов.