AMD Radeon RX 5600 XT, 6 GB

Ja. Mit dieser Karte läuft Gemma 4 E2B flüssig, mit rund 51 bis 95 Token pro Sekunde.

Die Grenze dieser Karte: Gemma 4 E2B läuft noch, Teuken 7B nicht mehr. Dafür fehlen 0,8 GB Grafikspeicher.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“), nur mit dem Grafikspeicher der Karte: ohne Auslagerung in den Arbeitsspeicher und ohne Prozessor. Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf dieser Karte gemessen. Ausgenommen sind Werte mit dem Zusatz „nicht an Messungen abgeglichen“: für sie fehlt der Abgleich, sie sind unsicher.

Wofür möchten Sie die Karte nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis

Stärkstes Modell, das flüssig läuft

Gemma 4 E2B

Q4_K_M · 51 bis 95 Token/s

So starten Sie es mit Ollama:

$ ollama run hf.co/unsloth/gemma-4-E2B-it-GGUF:Q4_K_M

Oder mit llama.cpp, mit dem Kontext dieser Seite (lädt das Modell von Hugging Face):

$ llama-server -hf unsloth/gemma-4-E2B-it-GGUF:Q4_K_M -c 4096

Schnellstes Modell

MiniCPM5 2B

Q4_K_M · 93 bis 173 Token/s

Das schnellste unter den flüssig laufenden Modellen mit mindestens halb so vielen Parametern wie das größte unter ihnen.

So starten Sie es mit Ollama:

$ ollama run hf.co/bartowski/MiniCPM5-2B-GGUF:Q4_K_M

Oder mit llama.cpp, mit dem Kontext dieser Seite (lädt das Modell von Hugging Face):

$ llama-server -hf bartowski/MiniCPM5-2B-GGUF:Q4_K_M -c 4096

Modelle auf dieser Karte

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

Kartendaten

Hersteller
AMD
Grafikspeicher
6 GB
Speicherbandbreite
288 GB/s
Rechenschnittstelle
Vulkan
Erschienen
2020

Bildmodelle auf dieser Karte

Ob ein Bildmodell in den Speicher passt, für ein Bild mit 1024 × 1024 Pixeln. Eine Zeit je Bild rechnen wir nicht.

ModellStandardstufeGrößte StufeSpeicher
Qwen-Image-2.1
Qwen Research License
passt nicht (Q4_K)12,1 von 5,2 GB
Qwen-Image-2512
Apache 2.0
passt nicht (Q4_K_M)20,4 von 5,2 GB

Weitere Ratgeber