FLUX.1 [dev]

FLUX.1 [dev] braucht mit der Stufe Q4_0 rund 12,3 GB Speicher und passt auf 404 von 703 geführten Geräten.

Auf 41 weiteren Geräten passt es nur mit Auslagerung: die Modelldateien liegen dann im Arbeitsspeicher, der Grafikspeicher trägt jeweils den Teil, der gerade rechnet. Wie lange ein Bild so dauert, haben wir dort nicht gemessen.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu der Rechenpuffer, den wir an Qwen-Image-2.1 mit den Schaltern --diffusion-fa und --vae-tiling gemessen haben. Ohne diese beiden Schalter braucht der VAE-Decoder allein rund 3,6 GB mehr.

Anbieter
Black Forest Labs
Parameter des Bildteils
11,9 Mrd.
Auf Hugging Face seit
31. Juli 2024
Lizenz
flux-1-dev-non-commercial-license
Text-Encoder
CLIP-L (FP16), 0,2 GB · T5-XXL Q4_0, 2,8 GB
VAE
ae.safetensors, 0,3 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli --diffusion-model flux1-dev-Q4_0.gguf --vae ae.safetensors --clip_l clip_l.safetensors --t5xxl t5xxl-Q4_0.gguf --diffusion-fa --vae-tiling -W 1024 -H 1024 --cfg-scale 1 --sampling-method euler -p "Ihr Bildwunsch" -o bild.png

Lizenz

Nur für nicht-kommerzielle Zwecke. Die Lizenz (flux-1-dev-non-commercial-license) sagt dazu wörtlich:

You may only access, use, Distribute, or create Derivatives of the FLUX.1 [dev] Model or Derivatives for Non-Commercial Purposes.
https://raw.githubusercontent.com/black-forest-labs/flux/main/model_licenses/LICENSE-FLUX1-dev, gelesen am 10. Oktober 2026

Für den Einsatz im Unternehmen kommt FLUX.1 [schnell] in Frage, das laut Modellkarte unter Apache 2.0 steht.

Zu den Bildern, die Sie damit erzeugen, sagt die Lizenz wörtlich:

You may use Output for any purpose (including for commercial purposes), except as expressly prohibited herein.
https://raw.githubusercontent.com/black-forest-labs/flux/main/model_licenses/LICENSE-FLUX1-dev

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Geräte, auf die es nur mit Auslagerung passt

Mit --offload-to-cpu liegen alle Modelldateien im Arbeitsspeicher, der Grafikspeicher trägt nur die Phase, die gerade rechnet: den Text-Encoder, den Bildteil oder den VAE-Decoder. Gemessen an Qwen-Image-2.1 auf unserer Karte kostete das 3 Sekunden mehr je Bild; für Qwen-Image-2512 und für schwächere Geräte kennen wir die Zeit nicht. Die zehn mit dem kleinsten Grafikspeicher, der reicht.

Startbefehl mit Auslagerung

$ sd-cli --diffusion-model flux1-dev-Q4_0.gguf --vae ae.safetensors --clip_l clip_l.safetensors --t5xxl t5xxl-Q4_0.gguf --diffusion-fa --vae-tiling --offload-to-cpu -W 1024 -H 1024 --cfg-scale 1 --sampling-method euler -p "Ihr Bildwunsch" -o bild.png

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 4060 Ti, 16 GB15,2 GBQ5_K_S
AMD Radeon RX 9060 XT, 16 GB15,2 GBQ5_K_S
NVIDIA GeForce RTX 5080, 16 GB15,2 GBQ5_K_S
NVIDIA GeForce RTX 5070 Ti, 16 GB15,2 GBQ5_K_S
AMD Radeon RX 7600 XT, 16 GB15,2 GBQ5_K_S
AMD Radeon RX 7800 XT, 16 GB15,2 GBQ5_K_S
NVIDIA GeForce RTX 4070 Ti SUPER, 16 GB15,2 GBQ5_K_S
AMD Radeon RX 9070, 16 GB15,2 GBQ5_K_S
AMD Radeon VII, 16 GB15,2 GBQ5_K_S
NVIDIA Quadro RTX 5000, 16 GB15,2 GBQ5_K_S

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
Q3_K_S5,2 GB10,8 GB
Q4_06,8 GB12,3 GB
Q4_K_S6,8 GB12,4 GB
Q5_K_S8,3 GB13,8 GB
Q6_K9,9 GB15,4 GB
Q8_012,7 GB18,3 GB

Quelle: https://huggingface.co/black-forest-labs/FLUX.1-dev · clip_l.safetensors · t5xxl-Q4_0.gguf

Weitere Ratgeber