Qwen3 8B
Qwen3 8B braucht mit der Variante Q4_K_M rund 6,5 GB Speicher und läuft auf 509 von 527 geführten Geräten flüssig.
Mit dem wenigsten Speicher schafft es: Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GB.
Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.
- Anbieter
- Alibaba (Qwen)
- Parameter
- 8,2 Mrd.
- Längster Kontext
- 40.960 Token
- Lizenz
- apache-2.0
So starten Sie es mit Ollama:
$ ollama run hf.co/Qwen/Qwen3-8B-GGUF:Q4_K_MGeräte, auf denen es flüssig läuft
Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.
und 499 weitere
Grafikkarten, in die es ganz passt
| Grafikkarte | Urteil | Tempo | Speicher |
|---|---|---|---|
| NVIDIA GeForce RTX 3070 Ti, 8 GB | Läuft gut | 75 bis 92 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 5060, 8 GB | Läuft gut | 57 bis 69 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 5060 Ti, 8 GB | Läuft gut | 57 bis 69 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3060 Ti, 8 GB | Läuft gut | 57 bis 69 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3070, 8 GB | Läuft gut | 57 bis 69 Token/s | 8 GB davon 7,2 GB nutzbar |
| AMD Radeon RX 9060 XT, 8 GB | Läuft gut | 34 bis 59 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 4060 Ti, 8 GB | Läuft gut | 37 bis 46 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 4060, 8 GB | Läuft gut | 35 bis 43 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3080, 10 GB | Läuft gut | 92 bis 113 Token/s | 10 GB davon 9,2 GB nutzbar |
| Intel Arc B570, 10 GB | Läuft gut | 39 bis 68 Token/s | 10 GB davon 9,2 GB nutzbar |
und 50 weitere
Alle Geräte und Grafikkarten für Qwen3 8B
Varianten
| Variante | Datei | Speicherbedarf | Startbefehl |
|---|---|---|---|
| Q4_K_M | 5,0 GB | 6,5 GB | ollama run hf.co/Qwen/Qwen3-8B-GGUF:Q4_K_M |
| Q5_K_M | 5,9 GB | 7,4 GB | ollama run hf.co/Qwen/Qwen3-8B-GGUF:Q5_K_M |
| Q6_K | 6,7 GB | 8,3 GB | ollama run hf.co/Qwen/Qwen3-8B-GGUF:Q6_K |
| Q8_0 | 8,7 GB | 10,3 GB | ollama run hf.co/Qwen/Qwen3-8B-GGUF:Q8_0 |