Qwen3.6 обошла Qwen3.5 не во всех тестах — автор разбора остался на старой

Автор Хабра сравнил две версии открытой модели Qwen в локальном запуске — на своём железе, без облака — и получил обратный ожидаемому результат.
Он прогнал семь квантованных сборок (моделей со сжатыми весами, чтобы они влезли в память) через шесть групп тестов и потратил почти миллиард токенов. Более новая Qwen3.6 не выиграла у Qwen3.5 по всем группам, а один из кандидатов, по его словам, оказался не той моделью, которой себя называл.
Вывод автора простой: его команда осталась на старой версии, потому что на их задачах она отвечает лучше.