Яндекс.Метрика
← Дайджест от 30 июля 2026

DeepSeek обновила V4 Flash: дешевле на задачу, но токенов тратит больше

DeepSeek выложила в API обновлённую V4-Flash-0731. Архитектура та же: 284 млрд параметров, из них 13 млрд работают на каждый запрос. По бенчмаркам новая версия обгоняет GLM 5.2 и предварительную V4 Pro.

По замерам Artificial Analysis модель расходует примерно столько же токенов, сколько прежняя, и в пересчёте на задачу выходит в разы дешевле GPT-5.6 Luna даже после свежего снижения цен. Обратная сторона — скорость: Luna решает те же задачи заметно быстрее и укладывается в меньшее число токенов. Модель работает через Responses API и совместима с Codex.