DeepSeek выложила веса V4-Flash под лицензией MIT
Вчера мы писали про обновление DeepSeek V4-Flash в API — сегодня компания выложила веса модели на Hugging Face под лицензией MIT, которая разрешает и коммерческое использование почти без ограничений.
Модель прежняя по устройству: 284 млрд параметров всего, 13 млрд работают на каждый запрос, контекст до миллиона токенов. Команда vLLM, которая делает популярный сервер для запуска моделей, описала детали: 256 экспертов в маршрутизации, шесть активных на токен, три уровня «глубины размышления» и встроенный модуль DSpark для спекулятивного декодирования — черновая модель предсказывает, основная проверяет.
Unsloth сразу опубликовала сжатые версии: примерно 168 ГБ оперативной памяти для четырёхбитной без потерь качества и 110 ГБ для трёхбитной. То есть локальный запуск возможен, но на машине с сотней с лишним гигабайт памяти, а не на рабочем ноутбуке.