Qwen-Image-2.1-Turbo

Qwen-Image-2.1-Turbo braucht mit der Stufe Q4_K_M rund 12,1 GB Speicher und passt auf 413 von 714 geführten Geräten.

Auf 170 weiteren Geräten passt es nur mit Auslagerung: die Modelldateien liegen dann im Arbeitsspeicher, der Grafikspeicher trägt jeweils den Teil, der gerade rechnet. Wie lange ein Bild so dauert, haben wir dort nicht gemessen.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu ein Rechenpuffer von 2,2 GB. An diesem Modell haben wir ihn nicht gemessen; der Wert stammt aus einer älteren Messung an Qwen-Image-2.1 und liegt über dem, was neuere Fassungen von stable-diffusion.cpp bei den gemessenen Modellen brauchen (bis 0,8 GB). Ohne die Schalter --diffusion-fa und --vae-tiling braucht der VAE-Decoder deutlich mehr.

Anbieter
Alibaba
Parameter des Bildteils
7,1 Mrd.
Auf Hugging Face seit
9. Oktober 2026
Lizenz
Qwen Research License
Text-Encoder
Qwen3-VL-8B-Instruct Q4_K_M, 5,0 GB
VAE
qwen_image_2.1_vae_bf16.safetensors, 0,7 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli --diffusion-model qwen-image-2.1-turbo-Q4_K_M.gguf --vae qwen_image_2.1_vae_bf16.safetensors --llm Qwen3VL-8B-Instruct-Q4_K_M.gguf --diffusion-fa --vae-tiling -W 1024 -H 1024 --cfg-scale 1 --steps 8 --sampling-method euler --sigmas 1.0,0.978453,0.95418,0.926626,0.89508,0.845148,0.704534,0.414568,0.0 -p "Ihr Bildwunsch" -o bild.png

Lizenz

Nur für nicht-kommerzielle Zwecke. Die Lizenz (Qwen Research License) sagt dazu wörtlich:

to use, reproduce, distribute, copy, create derivative works of, and make modifications to the Materials FOR NON-COMMERCIAL PURPOSES ONLY.
https://huggingface.co/Qwen/Qwen-Image-2.1-Turbo/raw/main/LICENSE, gelesen am 11. Oktober 2026

Für den Einsatz im Unternehmen kommt Qwen-Image-2512 in Frage, das laut Modellkarte unter Apache 2.0 steht.

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Geräte, auf die es nur mit Auslagerung passt

Mit --offload-to-cpu liegen alle Modelldateien im Arbeitsspeicher, der Grafikspeicher trägt nur die Phase, die gerade rechnet: den Text-Encoder, den Bildteil oder den VAE-Decoder. Gemessen an Qwen-Image-2.1 auf unserer Karte kostete das 3 Sekunden mehr je Bild; für Qwen-Image-2512 und für schwächere Geräte kennen wir die Zeit nicht. Die zehn mit dem kleinsten Grafikspeicher, der reicht.

Startbefehl mit Auslagerung

$ sd-cli --diffusion-model qwen-image-2.1-turbo-Q4_K_M.gguf --vae qwen_image_2.1_vae_bf16.safetensors --llm Qwen3VL-8B-Instruct-Q4_K_M.gguf --diffusion-fa --vae-tiling --offload-to-cpu -W 1024 -H 1024 --cfg-scale 1 --steps 8 --sampling-method euler --sigmas 1.0,0.978453,0.95418,0.926626,0.89508,0.845148,0.704534,0.414568,0.0 -p "Ihr Bildwunsch" -o bild.png

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 4060 Ti, 16 GB15,2 GBQ6_K
AMD Radeon RX 9060 XT, 16 GB15,2 GBQ6_K
NVIDIA GeForce RTX 5080, 16 GB15,2 GBQ6_K
NVIDIA GeForce RTX 5070 Ti, 16 GB15,2 GBQ6_K
AMD Radeon RX 7600 XT, 16 GB15,2 GBQ6_K
AMD Radeon RX 7800 XT, 16 GB15,2 GBQ6_K
NVIDIA GeForce RTX 4070 Ti SUPER, 16 GB15,2 GBQ6_K
AMD Radeon RX 9070, 16 GB15,2 GBQ6_K
AMD Radeon VII, 16 GB15,2 GBQ6_K
NVIDIA Quadro RTX 5000, 16 GB15,2 GBQ6_K

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
Q3_K_M3,2 GB11,1 GB
Q4_K_M4,2 GB12,1 GB
Q5_K_M5,4 GB13,3 GB
Q6_K6,3 GB14,2 GB
Q8_07,6 GB15,6 GB

Quelle: https://huggingface.co/Qwen/Qwen-Image-2.1-Turbo · Qwen3VL-8B-Instruct-Q4_K_M.gguf

Weitere Ratgeber