Qwen-Image-3.0: Alibaba делает ставку на «полезно» вместо «красиво»

Qwen-Image-3.0

Alibaba выкатила Qwen-Image-3.0 — третье поколение своей модели генерации изображений. Релиз случился 21 июля 2026 года, и главное, что бросается в глаза: команда Qwen прямо заявила, что больше не гонится за «красиво». Цель теперь — «полезно». То есть картинка должна быть не просто симпатичной, а пригодной для реальной работы: макета, инфографики, страницы документа.

Что изменилось по сравнению с предыдущими версиями

Первая версия Qwen-Image вышла в августе 2025 года с открытыми весами по лицензии Apache 2.0 и техническим отчётом в день релиза. Она принимала промпты примерно до 1000 токенов. Вторая версия тоже вышла с техническим отчётом.

Третья версия — совсем другая история. Лимит промпта вырос до 4500 токенов, это самое конкретное число, которое вообще есть в релизе. А вот весов модели, технического отчёта, карточки модели и каких-либо бенчмарков компания не опубликовала. Попробовать модель можно только через чат на сайте qwen.ai, цены на API пока не объявлены. Для серии, которая раньше всегда выкладывала веса и отчёты, это заметный разворот.

Три кита релиза

Команда Qwen построила презентацию вокруг трех идей.

Насыщенный контент. Благодаря увеличенному лимиту в 4500 токенов модель может собрать сложную композицию за один проход — без склейки отдельных картинок. В качестве примера показана сетка 3×3 с девятью разными инфографиками (физическая диаграмма, доказательство из теории групп, объяснение по биологии и так далее), сгенерированная из одной инструкции примерно на 3700 токенов. Ещё один пример — вложенные интерфейсы: редактор кода, внутри него окно чата, внутри чата — мессенджер.

Достоверные детали. Модель, по заявлению разработчиков, читаемо рисует текст размером от 10 пикселей и передаёт текстуры — кожу, волосы, поры — близко к фотографическому качеству. В демонстрациях есть страница научной статьи с многострочными формулами, имитация газетной полосы, добавление рукописных пометок и реставрация повреждённой картины.

Глубокие знания. Модель нативно рисует текст на 12 языках, умеет имитировать интерфейсы сайтов, игр и трансляций, а ещё подключается к интернету за актуальными данными. Пример из презентации — прогноз погоды для конкретного города на конкретную дату: модель не выдумывает цифры, а берёт их из сети и рисует правдоподобный график. Здесь модель уже больше похожа на инструмент дизайна на основе данных, чем на классический генератор картинок.

Заявленные сценарии применения — газетные полосы, раскадровки для коротких видео, макеты интерфейсов, карточки товаров для маркетплейсов.

Ложка дёгтя

Всё, что перечислено выше, показано на примерах, которые отобрала сама Alibaba. Никакой независимой проверки нет — ни весов, чтобы прогнать модель самому, ни оценочного набора, ни отчёта с методологией. Для текстовой модели это было бы не так критично, а для генератора изображений — довольно чувствительный момент: качество картинки субъективно, а рендер мелкого текста — как раз то место, где генераторы обычно хорошо выглядят на отобранных демках и заметно хуже — на системных тестах.

Есть и показательная деталь из прошлого. В собственном бенчмарке Qwen-Image-Bench, который команда Qwen публиковала для оценки текст-в-картинку моделей, предыдущий флагман — Qwen Image 2.0 Pro — занял только пятое место. Первым был GPT Image 2 от OpenAI, следом шли модели Nano Banana от Google и GPT Image 1.5. То есть стартовая позиция серии перед третьей версией была не лидерской, а место в середине топа. Это не значит, что третья версия хуже конкурентов — она вполне может быть заметным шагом вперёд, — но проверить это заявление пока попросту нечем.

Конкуренты, к слову, показывают, что закрытый релиз без весов — это выбор, а не вынужденная мера: например, HunyuanImage 3.0 от Tencent вышла с открытыми весами.

Где попробовать

Официально — в Qwen Chat на qwen.ai, там доступны и генерация с нуля, и режим редактирования (можно загрузить от одного до трёх референсных изображений и описать словами, что поменять).

Кроме официального чата, модель можно попробовать и через сторонние сервисы:

  • syntasy.pro — сервис с доступом к Qwen-Image-3.0 для генерации и редактирования изображений.
syntasy.pro

Ссылка: syntasy.pro

  • kie.ai — предлагает Qwen-Image-3.0-Pro через плейграунд и API, с разрешением до 2K и опцией автоматического улучшения промта для простых запросов.
kie.ai

Ссылка: kie.ai

  • qwen-image.org — бесплатный онлайн-генератор с режимами text-to-image, редактирования одного изображения и мультиредактирования сразу нескольких.
qwen-image.org

Ссылка: qwen-image.org

Официальный API с ценами Alibaba пока не опубликовала, поэтому сторонние площадки на данный момент — самый доступный способ подключить модель к своим проектам.

Как модель смотрится на фоне конкурентов

Прямого сравнения по цифрам пока нет, потому что Alibaba не опубликовала бенчмарки для третьей версии. Но кое-что понятно из того, как модель позиционируют, и из старых данных.

По фокусу. Большинство популярных генераторов вроде Reve, Nano Banana от Google и Seedream заточены под что-то одно: у кого-то это творческая свобода, у кого-то реализм, у кого-то удобное редактирование. Qwen-Image-3.0 работает иначе. Вместо одной яркой фишки команда сделала упор сразу на несколько вещей: длинные детализированные промпты, читаемый мелкий текст, сложные макеты с кучей элементов. По сути это инструмент для рабочих задач: документов, интерфейсов, инфографики.

По прошлым результатам. В своём же бенчмарке Qwen-Image-Bench предыдущая версия, Qwen Image 2.0 Pro, заняла только пятое место. Впереди были GPT Image 2 от OpenAI (лидер рейтинга), пара моделей Nano Banana от Google и GPT Image 1.5. То есть перед выходом третьей версии серия скорее догоняла лидеров, чем задавала тон. Изменилось ли что-то с выходом 3.0, непонятно: независимых тестов пока нет, а свежий бенчмарк Alibaba тоже не публиковала.

guest
0 комментариев
Старые
Новые Популярные