ASUS ProArt P16 16 Zoll (2025), GeForce RTX 5070 Laptop GPU, 32 GB

Vergleichen

Ja. Auf diesem Gerät läuft EuroLLM 9B flüssig, mit rund 44 bis 54 Token pro Sekunde (nicht an Messungen abgeglichen).

Die Grenze dieses Geräts: EuroLLM 9B läuft noch, Llama 3.3 70B nicht mehr. Dafür fehlen 12,3 GB nutzbarer Speicher.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind aus der Speicherbandbreite des Grafikchips berechnet. Für Grafikchips in Notebooks gibt es keinen Abgleich an Messungen, weil die Hersteller ihre Leistung unterschiedlich begrenzen.

Wofür möchten Sie das Gerät nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis

Stärkstes Modell, das flüssig läuft

EuroLLM 9B

Q4_K_M · 44 bis 54 Token/s

Dieses Tempo ist auf diesem Gerät nicht an Messungen abgeglichen und deshalb unsicher.

So starten Sie es mit Ollama:

$ ollama run hf.co/mradermacher/EuroLLM-9B-Instruct-2512-GGUF:Q4_K_M

Schnellstes Modell

LFM2.5 8B A1B

Q4_K_M · 140 bis 223 Token/s

Dieses Tempo ist auf diesem Gerät nicht an Messungen abgeglichen und deshalb unsicher.

Das schnellste unter den flüssig laufenden Modellen mit mindestens halb so vielen Parametern wie das größte unter ihnen.

So starten Sie es mit Ollama:

$ ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-GGUF:Q4_K_M

Modelle auf diesem Gerät

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

Gerätedaten

Grafikkarte
GeForce RTX 5070 Laptop GPU
Grafikspeicher
8 GB
Prozessor
AMD Ryzen AI 9 HX 370
Arbeitsspeicher
32 GB
Davon für Modelle nutzbar
7,2 GB
Speicherbandbreite
384 GB/s
Rechenschnittstelle
CUDA

Wo es dieses Gerät gibt

Preise aus den Produktdaten der Händler, zuletzt abgeglichen am 25. September 2026. Maßgeblich ist der Preis beim Händler. Partnerlinks: Kaufen Sie über einen dieser Links, erhalten wir eine Provision. Der Preis für Sie bleibt gleich, und die Einstufung oben hängt nicht davon ab.

Bildmodelle auf diesem Gerät

Ob ein Bildmodell in den Speicher passt, für ein Bild mit 1024 × 1024 Pixeln. Eine Zeit je Bild rechnen wir nicht.

ModellStandardstufeGrößte StufeSpeicher
Qwen-Image-2.1
Qwen Research License
passt mit Auslagerung (Q4_K)Q5_05,5 GB Grafikspeicher (davon 7,2 GB nutzbar) und 9,9 GB Arbeitsspeicher
Qwen-Image-2512
Apache 2.0
passt nicht (Q4_K_M)20,4 von 7,2 GB

Weitere Ratgeber