Stable Diffusion XL 1.0

Stable Diffusion XL 1.0 braucht mit der Stufe F16 rund 9,5 GB Speicher und passt auf 545 von 703 geführten Geräten.

Eine Zeit je Bild rechnen wir nicht. Ein Bildmodell hängt an der Rechenleistung, nicht an der Speicherbandbreite, und für einen Abgleich fehlen uns Messungen.

Gerechnet für ein Bild mit 1024 × 1024 Pixeln: alle Dateien des Startbefehls zusammen (Bildteil, Text-Encoder und VAE), dazu der Rechenpuffer, den wir an Qwen-Image-2.1 mit den Schaltern --diffusion-fa und --vae-tiling gemessen haben. Ohne diese beiden Schalter braucht der VAE-Decoder allein rund 3,6 GB mehr.

Anbieter
Stability AI
Parameter des Bildteils
2,6 Mrd.
Auf Hugging Face seit
25. Juli 2023
Lizenz
CreativeML Open RAIL++-M
Text-Encoder
in der Modelldatei enthalten
VAE
sdxl_vae.safetensors, 0,3 GB
Ollama
führt dieses Modell nicht

Startbefehl mit stable-diffusion.cpp

$ sd-cli -m sd_xl_base_1.0.safetensors --vae sdxl_vae.safetensors --diffusion-fa --vae-tiling -W 1024 -H 1024 -p "Ihr Bildwunsch" -o bild.png

Lizenz

Die Modellkarte nennt die Lizenz CreativeML Open RAIL++-M.

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Geräte, auf die es passt

Die zehn mit dem kleinsten Speicher, der reicht. Größte Stufe heißt: die genaueste, die noch in den Speicher passt.

Grafikkarten, in deren Speicher es passt

GrafikkarteNutzbarer SpeicherGrößte Stufe
NVIDIA GeForce RTX 2080 Ti, 11 GB10,2 GBF16
NVIDIA GeForce RTX 4070 Ti, 12 GB11,2 GBF16
NVIDIA GeForce RTX 3080 Ti, 12 GB11,2 GBF16
NVIDIA GeForce RTX 4070, 12 GB11,2 GBF16
Intel Arc B580, 12 GB11,2 GBF16
NVIDIA GeForce RTX 5070, 12 GB11,2 GBF16
NVIDIA GeForce RTX 3080, 12 GB11,2 GBF16
AMD Radeon RX 6700 XT, 12 GB11,2 GBF16
NVIDIA GeForce RTX 4070 SUPER, 12 GB11,2 GBF16
NVIDIA RTX A2000, 12 GB11,2 GBF16

Stufen des Bildteils

Speicherbedarf je Stufe, jeweils mit Text-Encoder, VAE und Rechenpuffer.

VarianteDateiSpeicherbedarf
F166,9 GB9,5 GB

Quelle: https://huggingface.co/stabilityai/stable-diffusion-xl-base-1.0

Weitere Ratgeber