← Свежий выпускQwen: новости
43 сюжета про Qwen из ежедневных выпусков, свежие сверху.
18 сентябряPrismML ужала модель Bonsai 2 в девять раз — она влезает на рабочую машину


3 источника·HN 563
›18 сентябряQwen выпустила мультимодальную модель Omni Flash с упором на видео


3 источника·HN 327·TG 17k›18 сентябряАгент ZCode отправлял рабочие папки с историей git в облако Alibaba без спроса



4 источника·HN 257
›15 сентябряAlibaba открыла инструмент ревью кода, который использует у себя
1 источник
›14 сентябряNari Labs выпустила речевые модели Qwen3-TTS и Qwen3-ASR

2 источника·HN 90
›11 сентябряTencent выпустила AuK — модель, которая правит готовые записи речи
1 источник·TG 16k›9 сентябряАвтор на Хабре пробовал ужать модель LLaMA-7B с 13 до 1 ГБ без дообучения
2 источника›8 сентябряМодель Qwen3.8 держит умеренное сжатие и разваливается от предельного — замер Quesma

2 источника·HN 218
›5 сентябряРазработчик запустил модель Qwen на нейроблоке Apple в обход процессора и видеоядра
1 источник›3 сентябряCerebras запустила открытую модель Qwen 3.8 27B на чипе размером с пластину

2 источника·HN 504
›3 сентябряQwen выпустила тест, в котором агент год управляет интернет-магазином
1 источник·TG 16k›2 сентябряQwen возглавила рейтинг Code Arena с отрывом меньше статистической погрешности

2 источника·X 125
›1 сентябряTogether AI снизила аренду ускорителя H100 с 5,49 до 3,99 доллара в час
1 источник·X 72
›31 августаМодель GLM-5.3-Flash обошла Qwen3.8-Flash-Next в рейтинге агентских задач
3 источника·X 1.3k
›30 августаОснователь Alibaba Джек Ма купил её акции на 76 млн долларов — поддержка ставки на ИИ
1 источник
›29 августаАвтор на Хабре ускорил модель Qwen3.8 вдвое на тех же двух RTX 3090
1 источник›26 августаQwen выложила модель Qwen3.8-Flash-Next — обучение вдевятеро дешевле прошлой



4 источника·HN 674·TG 20k›25 августаКоманда Qwen во вторник выложит Qwen3.8-Flash-Next на архитектуре следующего поколения


3 источника·HN 312·TG 13k
›25 августаAlibaba открыла превью Wan 3.0: тридцать секунд видео со звуком за один проход
1 источник
›24 августаСжатие Qwen 3.8 27B: четыре бита дают почти то же качество при 17 ГБ

2 источника
›23 августаQwen 3.8 27B разобрала закрытый формат за полчаса

2 источника·HN 159
›18 августаQwen3.8-27B выложили в версии без отказов под Apple Silicon
1 источник·TG 14k›18 августаXiaomi открыла MiDashengLM-Gen: звуковая сцена целиком по текстовому описанию
1 источник·TG 13k›17 августаQwen3.8-27B набрала 52 балла и встала рядом с моделями на триллионы параметров



4 источника·HN 752
›16 августаApple готовит модель для Китая, к обучению привлекли Alibaba
1 источник
›14 августаМодель Qwen3.8-27B вышла под лицензией Apache и запускается на своём железе



6 источников·HN 943·TG 22k
›14 августаTogether AI строит в Индии кластер на десять тысяч ускорителей B300
1 источник·X 234›14 августаHugging Face: локально чаще всего запускают модели Qwen, за ними Gemma
1 источник·X 215›13 августаUnsloth выпустила настольное приложение для запуска и обучения моделей

2 источника·TG 15k
›12 августаDeepSeek без анонса открыла доступ к V4 Pro через свой API


3 источника·HN 807
›12 августаQwen выложила веса своей самой большой модели на 2,4 трлн параметров



4 источника·HN 534·X 237·TG 14k
›12 августаРазреженные модели недобирают полтора раза на RTX 5090 не из-за маршрутизации
1 источник›10 августаMeta открыла веса модели Muse Glimmer на 30 млрд параметров



6 источников·HN 1062·X 41.8k
›7 августаСервер vLLM переписали на C++: вместо окружения на Python один бинарник

2 источника
›6 августаQwen назвала дату выхода открытой модели на 2,4 трлн параметров


3 источника·HN 465
›6 августаБелый дом вывел открытые модели из-под обязательной проверки перед релизом


3 источника·TG 13k›5 августаВ llama.cpp предложили кешировать горячих экспертов MoE в видеопамяти

2 источника
›5 августаQwen раскрыла планы: следующая большая модель на 2,4 трлн параметров
2 источника›4 августаЭксперимент на Хабре: модель нарочно ошибается, заметив маркер теста
1 источник›3 августаAlibaba выпустила Qwen3.8-Max на 2,4 трлн параметров



5 источников·HN 1067·X 191·TG 39k›3 августаAirLLM запускает модель на 70 млрд параметров на карте с 4 ГБ

3 источника·HN 212
›31 июляМТС протестировала девять OCR-моделей на рукописном русском
1 источник›29 июля«Расцензуренные» модели дают более уверенные прогнозы при той же точности

2 источника›