LLM Reference

Qwen Image Models by Alibaba

AlibabaApache 2.0Open source
4 models2025–2026

Last refreshed 2026-09-21. Next refresh: weekly.

Details

ResearcherAlibaba
LicenseApache 2.0OSI-approved
Commercial useCommercial use: permitted
Models4
Released2025–2026

Capabilities

Vision2 of 4 models
MultimodalAll models

About

Alibaba's Qwen Image family of text-to-image generation models built on Multimodal Diffusion Transformer (MMDiT) architecture. Achieves commercial-grade Chinese and English text rendering. Open-source on HuggingFace (Qwen/Qwen-Image), part of Alibaba's Tongyi/Qwen AI ecosystem.

Decision facts

Best fit
image generationimagemultimodal
Capability starting point
Qwen-Image-2.1 with multimodal inputs
Lowest tracked input
Not tracked
Closest related family
Ovis Image

Current Variants

Use-when guidance is based on each model's tracked capabilities, context window, release date, and replacement status.

4 in view

Use when the workload needs image generation, multimodal inputs, and image.

2026-09image generationmultimodal inputsimage
Qwen ImageCurrent

Use when the workload needs image generation, 20B parameters, and multimodal inputs.

2025-08image generation20B parametersmultimodal inputs

Use when the workload needs image editing and multimodal inputs.

Unknown releaseimage editingmultimodal inputs

Use when the workload needs image generation and multimodal inputs.

2025-08image generationmultimodal inputs

Release Timeline

3 release groups
2026-09
1 current
Qwen-Image-2.1
image generationmultimodal inputsimage
Current
2025-08
2 current
Qwen Image
image generation20B parametersmultimodal inputs
Current
Qwen Image Max
image generationmultimodal inputs
Current
Unknown release
1 current
Qwen Image Edit
image editingmultimodal inputs
Current

Specifications(4 models)

Qwen Image model specifications comparison
ModelReleasedParametersVisionMultimodal
Qwen-Image-2.12026-09—YesYes
Qwen Image2025-0820BNoYes
Qwen Image Edit——YesYes
Qwen Image Max2025-08—NoYes

Available From(2 providers)