Qwen выпустила мультимодальную модель Omni Flash с упором на видео
Команда Qwen выложила Qwen3.8-Omni-Flash — мультимодальную модель, которая принимает на вход текст, картинки, аудио и видео, с окном контекста в миллион токенов. Разработчики называют её первой в линейке, построенной вокруг агентных сценариев.
Главное изменение — работа с видео: модель лучше держит длинные ролики, делает по ним разборы и описания и, по заявлению команды, перестала выдумывать таймкоды. Текстовые способности остались на уровне обычной Qwen3.8 Flash.
Что говорят
_ache_Hacker News
Если производительность сопоставима — а обратного ничего не видно — то цены вход/выход: Gemini 1,5/9,0 против Qwen 3.8 0,15/0,47. Это гигантское снижение стоимости.
conceptionHacker News
3.8 Max — самая «вменяемая» модель: говорит нормально, не начинает самовольно творить (привет, Gemini), делает хорошие архитектурные выборы и не придирается по мелочам. Но боже, какая же она медленная, доступна только у Alibaba, да ещё и с жадным тарифом на токены.
syntaxingHacker News
«Аудиовизуальные показатели близки к Gemini 3.8 Flash, а по звуку в целом — выше» — если правда, это безумие: аудио и многоязычность были для многих главным козырем Gemini. Правда, ссылка на их новый harness на GitHub даёт 404.