Inception Labs выпустила Mercury 2.5 — диффузионную модель со ставкой на скорость

Inception Labs выпустила Mercury 2.5 — языковую модель на диффузии, то есть текст в ней не дописывается по слову слева направо, а проявляется целиком из шума, как картинка. Компания называет её самой способной диффузионной моделью на рынке.
Заявленный прирост качества — 40% к Mercury 2, скорость — больше 1100 токенов в секунду на распространённых ускорителях Nvidia. Ставка именно на скорость: у обычных моделей такие цифры достигаются специальным железом, здесь — за счёт архитектуры.
Stefano Ermon@StefanoErmon
Today we're excited to announce Mercury 2.5 It’s the most capable diffusion LLM on the market. It is a 40% jump in intelligence over Mercury 2 and runs at over 1,100 tokens/sec on widely available @NVIDIAAI GPUs. https://t.co/xFnPBuJ577 https://t.co/5h3FLhjQqY
5948 сентября 2026