
Qwen анонсировала Qwen-Image-3.0 — третью версию своей модели для генерации и редактирования изображений. Она принимает команды объёмом до 4,5 тысячи токенов, создает сложные композиции за один запрос и, по утверждениям разработчиков, воспроизводит читаемый текст размером от 10 пикселей.
Эта модель доступна в Qwen Studio — как в веб-версии, так и в приложениях для iOS, Android, macOS и Windows. Подробности можно найти в материале Postium.
Читайте также: 25 нейросетей для генерации изображений
Что может нейросеть Qwen-Image-3.0
Модель предназначена для создания изображений с множеством взаимосвязанных элементов: газетных полос, раскадровок, учебных материалов, инфографики и интерфейсов. В анонсе Qwen продемонстрировала сетку 3×3, где в каждой ячейке находится отдельная сложная схема с текстом, формулами и иллюстрациями. Вся сетка была создана за одну генерацию с инструкцией объёмом 3,7 тысячи токенов.

Qwen-Image-3.0 также обладает возможностью создания вложенных композиций. Например, в одном изображении можно задать интерфейс кода редактора, внутри него — окно Qwen Chat, затем мессенджер и постер. По словам компании, модель сохраняет структуру и визуальный стиль на каждом уровне.

В отдельном сообщении Qwen подчеркивает более высокую точность прорисовки мелкого текста, формул, дробей, индексов и специальных символов. В примерах модель создала страницу научной статьи, газетную полосу и рукописные заметки на фотографии книжной страницы.

Что касается редактирования изображений, Qwen-Image-3.0 может добавлять надписи и аннотации, а также восстанавливать утраченные элементы иллюстраций, сохраняя оригинальный стиль. В качестве примера компания продемонстрировала реставрацию традиционной китайской живописи.
Модель поддерживает 12 языков, более 100 художественных стилей, а также генерацию интерфейсов для сайтов, игр и трансляций. Qwen также представила создание исследовательской инфографики на основе фотографии: модель добавила подписи, шкалу, классификацию и увеличенные фрагменты.

Как использовать Qwen-Image-3.0
Запустите чат-бот Qwen, выберите режим генерации изображения, введите запрос и при необходимости прикрепите исходные изображения.

Для работы через API создайте ключ в Alibaba Cloud Model Studio и укажите в запросе модель qwen-image-3.0-pro.
Для редактирования загрузите исходное изображение и укажите, что нужно изменить: восстановить поврежденный участок, добавить пометки, новые элементы или изменить композицию.
Почему это важно? За последние два дня Alibaba представила Qwen3.8 Max Preview — предварительную версию флагманской языковой модели, а также линейку Qwen-Audio-3.0-TTS для озвучивания текста и клонирования голоса. Теперь компания обновила и генератор изображений: Qwen-Image-3.0 делает акцент на создании сложных макетов, работе с мелким текстом и точной передаче визуальных деталей.
Итог: Qwen-Image-3.0 расширяет возможности генерации изображений для создания сложных макетов, инфографики, интерфейсов и редактирования изображений.


