Alibaba открыла веса генератора изображений Qwen-Image-2.1
Alibaba открыла веса Qwen-Image-2.1 — модели, которая и генерирует, и редактирует изображения. Размер 7 млрд параметров, то есть её реально запустить на одной потребительской видеокарте.
Модель принимает до десяти референсных картинок сразу, умеет точечно править участок, сохраняя лицо или товар, и выдаёт изображения с прозрачным фоном без отдельного шага вырезания. Отдельно заявлена работа с текстом на картинке и инфографикой — то место, где генераторы обычно сыплются.
По собственному замеру Qwen модель обходит GPT Image 1.5 и Nano Banana 2.0, но бенчмарк сделан самой командой, независимых сравнений пока нет. Релиз стал одной из самых обсуждаемых тем дня на Hacker News — 508 очков.
Что говорят
fishfasellHacker News
Локальная генерация картинок, на мой взгляд, сейчас опережает локальную генерацию кода. Изображение получаю за секунды и качество куда выше, чем я ждал от локальной модели, а с кодом всё медленнее и заметно бледнее.
hn45e7pbijHacker News
С картинкой ты глянул на один кадр и остановился, а коду нужны сотни токенов, правильных подряд: одна плохая строка — и всё разваливается.
TomGardenHacker News
Впечатляет и немного пугает, что модель на 7B умеет такое. Последствия огромны. И у Qwen ведь пока нет водяных знаков?