NVIDIA RTX 2000 Ada Generation, 16 GB

Ja. Mit dieser Karte läuft Qwen3 14B flüssig, mit rund 19 bis 23 Token pro Sekunde.

Die Grenze dieser Karte: gpt-oss 20B läuft noch, EuroLLM 22B nicht mehr. Dafür fehlen 0,4 GB Grafikspeicher.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“), nur mit dem Grafikspeicher der Karte: ohne Auslagerung in den Arbeitsspeicher und ohne Prozessor. Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf dieser Karte gemessen. Ausgenommen sind Werte mit dem Zusatz „nicht an Messungen abgeglichen“: für sie fehlt der Abgleich, sie sind unsicher.

Wofür möchten Sie die Karte nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis

Stärkstes Modell, das flüssig läuft

Qwen3 14B

Q4_K_M · 19 bis 23 Token/s

So starten Sie es mit Ollama:

$ ollama run hf.co/Qwen/Qwen3-14B-GGUF:Q4_K_M

Schnellstes Modell

gpt-oss 20B

Q4_K_M · 60 bis 97 Token/s

Das schnellste unter den flüssig laufenden Modellen mit mindestens halb so vielen Parametern wie das größte unter ihnen.

So starten Sie es mit Ollama:

$ ollama run hf.co/unsloth/gpt-oss-20b-GGUF:Q4_K_M

Modelle auf dieser Karte

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

Kartendaten

Hersteller
NVIDIA
Grafikspeicher
16 GB
Speicherbandbreite
256 GB/s
Rechenschnittstelle
CUDA
Erschienen
2024

Wo es diese Karte gibt

Preise aus den Produktdaten der Händler, zuletzt abgeglichen am 3. Oktober 2026. Maßgeblich ist der Preis beim Händler. Partnerlinks: Kaufen Sie über einen dieser Links, erhalten wir eine Provision. Der Preis für Sie bleibt gleich, und die Einstufung oben hängt nicht davon ab.

Weitere Ratgeber