Gemma 4 E4B
Gemma 4 E4B braucht mit der Variante Q4_0 rund 5,6 GB Speicher und läuft auf 509 von 527 geführten Geräten flüssig.
Mit dem wenigsten Speicher schafft es: Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GB.
Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.
- Anbieter
- Parameter
- 7,5 Mrd.
- Längster Kontext
- 131.072 Token
- Lizenz
- apache-2.0
So starten Sie es mit Ollama:
$ ollama run hf.co/ggml-org/gemma-4-E4B-it-GGUF:Q4_0Geräte, auf denen es flüssig läuft
Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.
und 499 weitere
Grafikkarten, in die es ganz passt
| Grafikkarte | Urteil | Tempo | Speicher |
|---|---|---|---|
| NVIDIA GeForce RTX 3070 Ti, 8 GB | Läuft gut | 86 bis 105 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 5060, 8 GB | Läuft gut | 65 bis 79 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 5060 Ti, 8 GB | Läuft gut | 65 bis 79 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3060 Ti, 8 GB | Läuft gut | 65 bis 79 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3070, 8 GB | Läuft gut | 65 bis 79 Token/s | 8 GB davon 7,2 GB nutzbar |
| AMD Radeon RX 9060 XT, 8 GB | Läuft gut | 38 bis 67 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 4060 Ti, 8 GB | Läuft gut | 43 bis 52 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 4060, 8 GB | Läuft gut | 40 bis 49 Token/s | 8 GB davon 7,2 GB nutzbar |
| NVIDIA GeForce RTX 3080, 10 GB | Läuft gut | 105 bis 129 Token/s | 10 GB davon 9,2 GB nutzbar |
| Intel Arc B570, 10 GB | Läuft gut | 45 bis 78 Token/s | 10 GB davon 9,2 GB nutzbar |
und 50 weitere
Alle Geräte und Grafikkarten für Gemma 4 E4B
Varianten
| Variante | Datei | Speicherbedarf | Startbefehl |
|---|---|---|---|
| Q4_0 | 4,6 GB | 5,6 GB | ollama run hf.co/ggml-org/gemma-4-E4B-it-GGUF:Q4_0 |
| Q8_0 | 8,0 GB | 9,1 GB | ollama run hf.co/ggml-org/gemma-4-E4B-it-GGUF:Q8_0 |
| BF16 | 15,1 GB | 16,2 GB | ollama run hf.co/ggml-org/gemma-4-E4B-it-GGUF:BF16 |