Qwen-Image 3.0: нейросеть для фото с текстом, инфографикой и сложными макетами
Qwen-Image 3.0 от Alibaba: мелкий текст, плотные макеты и глубокие знания модели. Как попробовать Qwen3 Image и Qwen3 Image Pro в NEIRON без VPN.
Alibaba выпустила Qwen-Image 3.0 — третье поколение своей флагманской модели генерации изображений. Если ключевым словом Qwen-Image 1.0 была «точность», а Qwen-Image 2.0 добавила «разнообразие, полноту, красоту и достоверность», то у версии 3.0 фокус сузился до одного слова — «реальность». Модель перестала бороться только за красивую картинку и начала решать задачи, которые раньше требовали дизайнера, верстальщика или художника-реставратора.
Реальность здесь раскладывается на три составляющие: насыщенный контент, достоверные детали и глубокие знания. Разберём, что стоит за каждой из них.
Насыщенный контент: сложные макеты за один проход
Qwen-Image 3.0 принимает промпт длиной до 4,5 тысяч токенов — этого достаточно, чтобы одним запросом описать не одну сцену, а целую композицию из множества смысловых блоков: газетную полосу, раскадровку короткого ролика, лист экзаменационных заданий с формулами и схемами.
Показательный пример из тестов модели — сложная сетка 3×3, где каждая из девяти ячеек представляет собой отдельную плотную инфографику: комикс про безопасность в тоннеле, разбор геометрической задачи, стилистический анализ классического китайского текста, схему движения тела при броске, объяснение жизненного цикла паразита, медицинскую иллюстрацию боли в грудной клетке, теоремы Силова из теории групп, инфографику внутреннего контроля банка и сравнение структур ДНК клетки. Все девять блоков — с точным китайским и английским текстом, формулами, диаграммами и персонажами — модель собрала за один проход по единому промпту на 3,7 тысячи токенов, а не склеивала из отдельных генераций.
Это «горизонтальное» расширение контента — способность аккуратно разместить много независимых смысловых блоков в одной композиции, не давая им «наезжать» друг на друга логически или визуально. Есть и «глубина»: модель умеет строить вложенные интерфейсы друг в друге — например, в одном промпте описать окно редактора кода, в котором открыт чат, а в чате — скриншот мессенджера, а в нём — постер кофейни, и на каждом уровне сохранить аутентичный стиль своего интерфейса.
Зачем это на практике: одним запросом можно собрать раскадровку для видео, макет презентации, обучающую инфографику или карточку товара со сложной структурой — без ручной вёрстки в графическом редакторе.
Достоверные детали: мелкий текст и живая фактура
Если насыщенность контента — это «сколько нарисовать», то достоверность деталей — «насколько точно». Здесь Qwen-Image 3.0 держит текст размером от 10 пикселей читаемым, а поры кожи и отдельные волоски передаёт на уровне, близком к фотографии.
Отдельный стресс-тест для модели — научные статьи с плотными формулами: верхние и нижние индексы, греческие буквы, дробные черты, многострочное выравнивание — ни один символ не должен «поплыть», даже при мелком кегле. Модель справляется и с реалистичной печатной версткой: генерирует газетную полосу с плотным текстом и одновременно имитирует фактуру настоящей газетной бумаги.
В задачах редактирования Qwen-Image 3.0 умеет добавлять на существующее изображение рукописные пометки — подчёркивания, стрелки, волнистые линии, короткие комментарии — так, что почерк выглядит естественным, будто это конспект школьника, а не сгенерированный слой. А если дать модели повреждённую классическую картину, она восстановит утраченные фрагменты, сохранив исходную манеру письма: растушёвку туши, фактуру перьев, композиционный баланс — убирая пятна и следы повреждений, но не «переизобретая» стиль автора.
Глубокие знания: языки, стили и мировой контекст
Третья опора — широта: Qwen-Image 3.0 корректно рендерит текст на 12 языках, работает с множеством шрифтов и более чем сотней художественных стилей, а также умеет имитировать реалистичные интерфейсы — веб-страницы, игровые меню, окна стрима.
Модель опирается на богатые фоновые знания о мире: например, может достроить научную инфографику вокруг реальной фотографии насекомого — добавить таксономические подписи, морфологические пометки, увеличенные детали и масштабную линейку, — получив результат, пригодный для публикации. При наличии доступа в интернет модель способна подтягивать актуальные данные (например, собрать инфографику прогноза погоды на конкретную дату) и узнавать конкретных публичных персон для сюжетных сцен с их участием.
Qwen3 Image в NEIRON: как попробовать без VPN
В NEIRON модель уже подключена в двух вариантах — Qwen3 Image и Qwen3 Image Pro. Обе версии принимают текстовый промпт и до трёх референсных изображений (JPG, PNG, WEBP, BMP, TIFF, GIF, до 10 МБ каждое); без референсов работают в режиме text-to-image. Доступны основные форматы кадра — 1:1, 4:3, 3:4, 16:9, 9:16, 3:2, 2:3 — и качество 1K или 2K. Pro-версия рассчитана на плотные макеты и мелкий текст и стоит заметно дороже базовой на разрешении 2K.
- Зарегистрируйтесь на neiron.space — работает в браузере и в Telegram Mini App, без VPN.
- Откройте раздел Создать и выберите режим «Фото».
- Выберите модель Qwen3 Image для черновиков или Qwen3 Image Pro для плотных макетов с текстом.
- Опишите композицию промптом на русском — чем подробнее структура (сколько блоков, что где расположено), тем точнее модель соберёт макет.
- Сгенерируйте и при необходимости повторите с уточнённым промптом или добавленным референсом.
Qwen-Image 3.0 закрывает нишу, где раньше нейросети сдавались первыми: плотный текст, многоблочные макеты и мелкие детали вроде формул и рукописных пометок. Для портрета или живой фотосъёмки по-прежнему стоит смотреть на другие модели, но для инфографики, раскадровок, карточек с текстом и восстановления изображений Qwen3 Image — рабочий инструмент, который в NEIRON доступен сразу, без отдельной регистрации у Alibaba.
Qwen3 Image — попробовать бесплатно
Qwen3 Image и Qwen3 Image Pro на русском, без VPN. Первая генерация — после регистрации.
Начать бесплатно