DeepSeek 4.1 Flash догнала дорогие модели на типовых задачах — разбор в блоге
Автор блога dgt.is спрашивает, почему отрасль спокойно отнеслась к выходу DeepSeek 4.1 Flash. По его замерам, дешёвая модель закрывает задачи, за которые ещё недавно платили в разы больше, и разрыв с дорогими западными моделями на типовой работе почти исчез.
Он связывает тишину с усталостью: релизов так много, что отдельный скачок качества перестали замечать, пока он не ударит по счетам.
В комментариях на Hacker News спорят о замерах — часть читателей говорит, что на длинных задачах с инструментами разрыв сохраняется, и лёгкая модель срывается там, где дорогая доводит до конца.
Что говорят
giancarlostoroHacker News
Посчитайте требования: FP16 — около 1664 ГБ VRAM (кластер 8x B300 по 288 ГБ), INT8 — ~832 ГБ (8x H200 141 ГБ), INT4 — ~416 ГБ (8x A100 80 ГБ). VRAM стоит дорого, Nvidia не выпускает достаточно потребительских видеокарт, у меня до сих пор друзья сидят на 1070 — карты слишком долго были безумно переоценены.
wg0Hacker News
Проектировал систему на DeepSeek v4.1 Flash и сам ошибся с границами RPC, что дорого мне обошлось. Потом запустил Fabble 5.5 на высоком режиме проверить, правда ли весь этот хайп: она сожрала 89% квоты и не нашла НИЧЕГО, что DeepSeek уже не отметила бы в своих заметках.