FLUX.2 [klein] 9B

FLUX.2 [klein] 9B braucht mit der Stufe Q4_K_M rund 13,5 GB Speicher und passt auf 404 von 703 geführten Geräten.

Auf 115 weiteren Geräten passt es nur mit Auslagerung: die Modelldateien liegen dann im Arbeitsspeicher, der Grafikspeicher trägt jeweils den Teil, der gerade rechnet. Wie lange ein Bild so dauert, haben wir dort nicht gemessen.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu der Rechenpuffer, den wir an Qwen-Image-2.1 mit den Schaltern --diffusion-fa und --vae-tiling gemessen haben. Ohne diese beiden Schalter braucht der VAE-Decoder allein rund 3,6 GB mehr.

Anbieter
Black Forest Labs
Parameter des Bildteils
9,1 Mrd.
Auf Hugging Face seit
14. Januar 2026
Lizenz
FLUX Non-Commercial License
Text-Encoder
Qwen3-8B Q4_K_M, 5,0 GB
VAE
flux2-vae.safetensors, 0,3 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli --diffusion-model flux-2-klein-9b-Q4_K_M.gguf --vae flux2-vae.safetensors --llm Qwen3-8B-Q4_K_M.gguf --diffusion-fa --vae-tiling -W 1024 -H 1024 --cfg-scale 1 --steps 4 -p "Ihr Bildwunsch" -o bild.png

Lizenz

Nur für nicht-kommerzielle Zwecke. Die Lizenz (FLUX Non-Commercial License) sagt dazu wörtlich:

You may only access, use, Distribute, or create Derivatives of the FLUX Model or Derivatives for Non-Commercial Purposes.
https://raw.githubusercontent.com/black-forest-labs/flux2/main/model_licenses/LICENSE-FLUX-NON-COMMERICAL, gelesen am 9. Oktober 2026

Für den Einsatz im Unternehmen kommt FLUX.2 [klein] 4B in Frage, das laut Modellkarte unter Apache 2.0 steht.

Zu den Bildern, die Sie damit erzeugen, sagt die Lizenz wörtlich:

You may use Output for any purpose (including for commercial purposes), except as expressly prohibited herein.
https://raw.githubusercontent.com/black-forest-labs/flux2/main/model_licenses/LICENSE-FLUX-NON-COMMERICAL

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Geräte, auf die es nur mit Auslagerung passt

Mit --offload-to-cpu liegen alle Modelldateien im Arbeitsspeicher, der Grafikspeicher trägt nur die Phase, die gerade rechnet: den Text-Encoder, den Bildteil oder den VAE-Decoder. Gemessen an Qwen-Image-2.1 auf unserer Karte kostete das 3 Sekunden mehr je Bild; für Qwen-Image-2512 und für schwächere Geräte kennen wir die Zeit nicht. Die zehn mit dem kleinsten Grafikspeicher, der reicht.

Startbefehl mit Auslagerung

$ sd-cli --diffusion-model flux-2-klein-9b-Q4_K_M.gguf --vae flux2-vae.safetensors --llm Qwen3-8B-Q4_K_M.gguf --diffusion-fa --vae-tiling --offload-to-cpu -W 1024 -H 1024 --cfg-scale 1 --steps 4 -p "Ihr Bildwunsch" -o bild.png

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 4060 Ti, 16 GB15,2 GBQ5_K_M
AMD Radeon RX 9060 XT, 16 GB15,2 GBQ5_K_M
NVIDIA GeForce RTX 5080, 16 GB15,2 GBQ5_K_M
NVIDIA GeForce RTX 5070 Ti, 16 GB15,2 GBQ5_K_M
AMD Radeon RX 7600 XT, 16 GB15,2 GBQ5_K_M
AMD Radeon RX 7800 XT, 16 GB15,2 GBQ5_K_M
NVIDIA GeForce RTX 4070 Ti SUPER, 16 GB15,2 GBQ5_K_M
AMD Radeon RX 9070, 16 GB15,2 GBQ5_K_M
AMD Radeon VII, 16 GB15,2 GBQ5_K_M
NVIDIA Quadro RTX 5000, 16 GB15,2 GBQ5_K_M

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
Q3_K_M4,8 GB12,3 GB
Q4_K_M5,9 GB13,5 GB
Q5_K_M7,0 GB14,6 GB
Q6_K7,9 GB15,4 GB
Q8_010,0 GB17,6 GB

Quelle: https://huggingface.co/black-forest-labs/FLUX.2-klein-9B · Qwen3-8B-Q4_K_M.gguf

Weitere Ratgeber