Chroma1-HD

Chroma1-HD braucht mit der Stufe Q4_K_M rund 10,9 GB Speicher und passt auf 460 von 703 geführten Geräten.

Auf 118 weiteren Geräten passt es nur mit Auslagerung: die Modelldateien liegen dann im Arbeitsspeicher, der Grafikspeicher trägt jeweils den Teil, der gerade rechnet. Wie lange ein Bild so dauert, haben wir dort nicht gemessen.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu der Rechenpuffer, den wir an Qwen-Image-2.1 mit den Schaltern --diffusion-fa und --vae-tiling gemessen haben. Ohne diese beiden Schalter braucht der VAE-Decoder allein rund 3,6 GB mehr.

Anbieter
lodestones
Parameter des Bildteils
8,9 Mrd.
Auf Hugging Face seit
8. August 2025
Lizenz
Apache 2.0
Text-Encoder
T5-XXL Q4_0, 2,8 GB
VAE
ae.safetensors, 0,3 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli --diffusion-model Chroma1-HD-Q4_K_M.gguf --vae ae.safetensors --t5xxl t5xxl-Q4_0.gguf --diffusion-fa --vae-tiling -W 1024 -H 1024 --cfg-scale 4 --sampling-method euler --model-args chroma_use_dit_mask=false -p "Ihr Bildwunsch" -o bild.png

Lizenz

Die Modellkarte nennt die Lizenz Apache 2.0.

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Geräte, auf die es nur mit Auslagerung passt

Mit --offload-to-cpu liegen alle Modelldateien im Arbeitsspeicher, der Grafikspeicher trägt nur die Phase, die gerade rechnet: den Text-Encoder, den Bildteil oder den VAE-Decoder. Gemessen an Qwen-Image-2.1 auf unserer Karte kostete das 3 Sekunden mehr je Bild; für Qwen-Image-2512 und für schwächere Geräte kennen wir die Zeit nicht. Die zehn mit dem kleinsten Grafikspeicher, der reicht.

Startbefehl mit Auslagerung

$ sd-cli --diffusion-model Chroma1-HD-Q4_K_M.gguf --vae ae.safetensors --t5xxl t5xxl-Q4_0.gguf --diffusion-fa --vae-tiling --offload-to-cpu -W 1024 -H 1024 --cfg-scale 4 --sampling-method euler --model-args chroma_use_dit_mask=false -p "Ihr Bildwunsch" -o bild.png

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 4070 Ti, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 3080 Ti, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 4070, 12 GB11,2 GBQ4_K_M
Intel Arc B580, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 5070, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 3080, 12 GB11,2 GBQ4_K_M
AMD Radeon RX 6700 XT, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 4070 SUPER, 12 GB11,2 GBQ4_K_M
NVIDIA RTX A2000, 12 GB11,2 GBQ4_K_M
NVIDIA GeForce RTX 3060, 12 GB11,2 GBQ4_K_M

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
Q3_K_S4,3 GB9,6 GB
Q4_K_M5,6 GB10,9 GB
Q5_K_M6,7 GB11,9 GB
Q6_K7,7 GB12,9 GB
Q8_09,7 GB15,0 GB

Quelle: https://huggingface.co/lodestones/Chroma1-HD · t5xxl-Q4_0.gguf

Weitere Ratgeber