FLUX.2 [klein] 4B

FLUX.2 [klein] 4B braucht mit der Stufe Q4_K_M rund 7,6 GB Speicher und passt auf 545 von 703 geführten Geräten.

Auf 125 weiteren Geräten passt es nur mit Auslagerung: die Modelldateien liegen dann im Arbeitsspeicher, der Grafikspeicher trägt jeweils den Teil, der gerade rechnet. Wie lange ein Bild so dauert, haben wir dort nicht gemessen.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu der Rechenpuffer, den wir an Qwen-Image-2.1 mit den Schaltern --diffusion-fa und --vae-tiling gemessen haben. Ohne diese beiden Schalter braucht der VAE-Decoder allein rund 3,6 GB mehr.

Anbieter
Black Forest Labs
Parameter des Bildteils
3,9 Mrd.
Auf Hugging Face seit
14. Januar 2026
Lizenz
Apache 2.0
Text-Encoder
Qwen3-4B Q4_K_M, 2,5 GB
VAE
flux2-vae.safetensors, 0,3 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli --diffusion-model flux-2-klein-4b-Q4_K_M.gguf --vae flux2-vae.safetensors --llm Qwen3-4B-Q4_K_M.gguf --diffusion-fa --vae-tiling -W 1024 -H 1024 --cfg-scale 1 --steps 4 -p "Ihr Bildwunsch" -o bild.png

Lizenz

Die Modellkarte nennt die Lizenz Apache 2.0.

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Geräte, auf die es nur mit Auslagerung passt

Mit --offload-to-cpu liegen alle Modelldateien im Arbeitsspeicher, der Grafikspeicher trägt nur die Phase, die gerade rechnet: den Text-Encoder, den Bildteil oder den VAE-Decoder. Gemessen an Qwen-Image-2.1 auf unserer Karte kostete das 3 Sekunden mehr je Bild; für Qwen-Image-2512 und für schwächere Geräte kennen wir die Zeit nicht. Die zehn mit dem kleinsten Grafikspeicher, der reicht.

Startbefehl mit Auslagerung

$ sd-cli --diffusion-model flux-2-klein-4b-Q4_K_M.gguf --vae flux2-vae.safetensors --llm Qwen3-4B-Q4_K_M.gguf --diffusion-fa --vae-tiling --offload-to-cpu -W 1024 -H 1024 --cfg-scale 1 --steps 4 -p "Ihr Bildwunsch" -o bild.png

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 3080, 10 GB9,2 GBQ6_K
Intel Arc B570, 10 GB9,2 GBQ6_K
AMD Radeon RX 6700, 10 GB9,2 GBQ6_K
NVIDIA GeForce RTX 2080 Ti, 11 GB10,2 GBQ8_0
NVIDIA GeForce RTX 4070 Ti, 12 GB11,2 GBQ8_0
NVIDIA GeForce RTX 3080 Ti, 12 GB11,2 GBQ8_0
NVIDIA GeForce RTX 4070, 12 GB11,2 GBQ8_0
Intel Arc B580, 12 GB11,2 GBQ8_0
NVIDIA GeForce RTX 5070, 12 GB11,2 GBQ8_0
NVIDIA GeForce RTX 3080, 12 GB11,2 GBQ8_0

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
Q3_K_M2,1 GB7,2 GB
Q4_K_M2,6 GB7,6 GB
Q5_K_M3,1 GB8,1 GB
Q6_K3,4 GB8,5 GB
Q8_04,3 GB9,3 GB

Quelle: https://huggingface.co/black-forest-labs/FLUX.2-klein-4B · Qwen3-4B-Q4_K_M.gguf

Weitere Ratgeber