Qwen-Image-2.1
★ 1.6KQwen's 7B text-to-image and image-editing diffusion model (32-layer single-stream DiT) with native RGBA transparency, up to 10 reference images, mask/local edits, and 2K output. Ships Diffusers, ComfyUI, vLLM-Omni and SGLang integrations plus prompt-rewriting checkpoints.
AI Frameworks | Python · text-to-image · image-editing
View Project →