Skip to main content
Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей

Qwen анонсировала Qwen-Image-3.0 — третью версию своей модели для генерации и редактирования изображений. Она принимает команды объёмом до 4,5 тысячи токенов, создает сложные композиции за один запрос и, по утверждениям разработчиков, воспроизводит читаемый текст размером от 10 пикселей.

Эта модель доступна в Qwen Studio — как в веб-версии, так и в приложениях для iOS, Android, macOS и Windows. Подробности можно найти в материале Postium.

Читайте также: 25 нейросетей для генерации изображений

Что может нейросеть Qwen-Image-3.0

Модель предназначена для создания изображений с множеством взаимосвязанных элементов: газетных полос, раскадровок, учебных материалов, инфографики и интерфейсов. В анонсе Qwen продемонстрировала сетку 3×3, где в каждой ячейке находится отдельная сложная схема с текстом, формулами и иллюстрациями. Вся сетка была создана за одну генерацию с инструкцией объёмом 3,7 тысячи токенов.

Что умеет нейросеть Qwen-Image-3.0

Qwen-Image-3.0 также обладает возможностью создания вложенных композиций. Например, в одном изображении можно задать интерфейс кода редактора, внутри него — окно Qwen Chat, затем мессенджер и постер. По словам компании, модель сохраняет структуру и визуальный стиль на каждом уровне.

Генерация сложного макета

В отдельном сообщении Qwen подчеркивает более высокую точность прорисовки мелкого текста, формул, дробей, индексов и специальных символов. В примерах модель создала страницу научной статьи, газетную полосу и рукописные заметки на фотографии книжной страницы.

Qwen заявляет о более точной прорисовке мелкого текста

Что касается редактирования изображений, Qwen-Image-3.0 может добавлять надписи и аннотации, а также восстанавливать утраченные элементы иллюстраций, сохраняя оригинальный стиль. В качестве примера компания продемонстрировала реставрацию традиционной китайской живописи.

Модель поддерживает 12 языков, более 100 художественных стилей, а также генерацию интерфейсов для сайтов, игр и трансляций. Qwen также представила создание исследовательской инфографики на основе фотографии: модель добавила подписи, шкалу, классификацию и увеличенные фрагменты.

Генерация инфографики

Как использовать Qwen-Image-3.0

Запустите чат-бот Qwen, выберите режим генерации изображения, введите запрос и при необходимости прикрепите исходные изображения.

Как пользоваться Qwen-Image-3.0

Для работы через API создайте ключ в Alibaba Cloud Model Studio и укажите в запросе модель qwen-image-3.0-pro.

Для редактирования загрузите исходное изображение и укажите, что нужно изменить: восстановить поврежденный участок, добавить пометки, новые элементы или изменить композицию.

Почему это важно? За последние два дня Alibaba представила Qwen3.8 Max Preview — предварительную версию флагманской языковой модели, а также линейку Qwen-Audio-3.0-TTS для озвучивания текста и клонирования голоса. Теперь компания обновила и генератор изображений: Qwen-Image-3.0 делает акцент на создании сложных макетов, работе с мелким текстом и точной передаче визуальных деталей.

Итог: Qwen-Image-3.0 расширяет возможности генерации изображений для создания сложных макетов, инфографики, интерфейсов и редактирования изображений.

Alibaba Qwen Нейросети

Close Menu
Новости интернет маркетинга, сайтов, новости нейросетей и технологий