Alibaba представила Qwen-Image-3.0: генерация инфографики и читаемого текста за один проход
Новинка от команды Qwen — Qwen-Image-3.0 — способна обрабатывать инструкции до 4500 токенов и генерировать изображения с разборчивым текстом высотой от 10 пикселей. Это позволяет создавать полноценные инфографические сетки, страницы научных статей в LaTeX и газетные полосы за один проход, без постобработки.
Модель нативно поддерживает 12 языков, что расширяет её применимость для международных задач. Однако практическая ценность таких возможностей остаётся под вопросом: итоговый вывод — это растровое изображение, а не редактируемый формат, поэтому внесение правок в сгенерированный макет затруднено.
Qwen-Image-3.0 продолжает линейку генеративных моделей Alibaba, делая акцент на точности текста в изображениях и работе со сложными композициями. Релиз доступен на платформе Qwen, примеры использования пока демонстрируют скорее техническую демонстрацию, чем готовый продукт для повседневных задач.