ASUS ExpertCenter Pro ET900N G3 (2026), NVIDIA GB300 mit Blackwell-Ultra-GPU, 748 GB

Ja. Auf diesem Gerät läuft Ornith 1.5 397B flüssig, mit rund 77 bis 115 Token pro Sekunde.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Wofür möchten Sie das Gerät nutzen?

Größtes Modell, das flüssig läuft

Ornith 1.5 397B

Q4_K_M · 77 bis 115 Token/s

So starten Sie es mit Ollama:

$ ollama run hf.co/ornith-ai/Ornith-1.5-397B-GGUF:Q4_K_M

Modelle auf diesem Gerät

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

ModellUrteilTempoSpeicher
Ornith 1.5 397B
Q4_K_M
Läuft gut77 bis 115 Token/s250,1 von 252,0 GB
Llama 3.3 70B
Q4_K_M
Läuft gut56 bis 69 Token/s45,5 von 252,0 GB
Qwen3.5 122B A10B
Q4_K_M
Läuft gut111 bis 167 Token/s79,0 von 252,0 GB
Gemma 4 31B
Q4_K_M
Läuft gut127 bis 156 Token/s20,7 von 252,0 GB
Laguna S 2.1
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut115 bis 173 Token/s110,8 von 252,0 GB
Granite 4.2 30B
Q4_K_M
Läuft gut134 bis 164 Token/s20,0 von 252,0 GB
Qwen3.8 27B
Q4_K_M
Läuft gut145 bis 178 Token/s17,9 von 252,0 GB
Qwen3.6 27B
Q4_K_M
Läuft gut145 bis 178 Token/s18,2 von 252,0 GB
gpt-oss 120B
Q4_K_M
Läuft gut223 bis 334 Token/s65,0 von 252,0 GB
Mistral Small 3.2 24B
Q4_K_M
Läuft gut167 bis 204 Token/s16,1 von 252,0 GB
Qwen3 14B
Q4_K_M
Läuft gut264 bis 323 Token/s10,7 von 252,0 GB
Ministral 3 14B
Q4_K_M
Läuft gut288 bis 352 Token/s9,9 von 252,0 GB
Gemma 4 12B
Q4_0
Läuft gut331 bis 405 Token/s8,3 von 252,0 GB
Ornith 1.5 35B A3B
Q4_K_M
Läuft gut372 bis 557 Token/s23,0 von 252,0 GB
Qwen3.6 35B A3B
Q4_K_M
Läuft gut369 bis 554 Token/s23,5 von 252,0 GB
Qwen3 30B A3B 2507
Q4_K_M
Läuft gut334 bis 501 Token/s20,1 von 252,0 GB
Qwen3-Coder 30B A3B
Q4_K_M
Läuft gut334 bis 501 Token/s20,1 von 252,0 GB
Gemma 4 26B A4B
Q4_K_M
Läuft gut285 bis 427 Token/s18,4 von 252,0 GB
Ornith 1.5 9B
Q4_K_M
Läuft gut423 bis 517 Token/s6,9 von 252,0 GB
Qwen3.5 9B
Q4_K_M
Läuft gut433 bis 529 Token/s6,7 von 252,0 GB
gpt-oss 20B
Q4_K_M
Läuft gut314 bis 471 Token/s12,8 von 252,0 GB
Qwen3 8B
Q4_K_M
Läuft gut470 bis 574 Token/s6,5 von 252,0 GB
Llama 3.1 8B
Q4_K_M
Läuft gut481 bis 587 Token/s6,4 von 252,0 GB
Gemma 4 E4B
Q4_0
Läuft gut525 bis 641 Token/s5,6 von 252,0 GB
Gemma 4 E2B
Q4_K_M
Läuft gut814 bis 995 Token/s4,0 von 252,0 GB
Qwen3.5 4B
Q4_K_M
Läuft gut903 bis 1.103 Token/s3,7 von 252,0 GB
Qwen3 4B
Q4_K_M
Läuft gut925 bis 1.131 Token/s4,0 von 252,0 GB
LFM2.5 8B A1B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut693 bis 1.040 Token/s6,9 von 252,0 GB
LFM2.5 2.6B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut1.403 bis 1.715 Token/s2,8 von 252,0 GB
GLM-5.3 Flash
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht381,5 von 252,0 GB
GLM-5.3
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht895,4 von 252,0 GB

Gerätedaten

Chip
NVIDIA GB300, Blackwell-Ultra-GPU
Arbeitsspeicher
748 GB
Davon für Modelle nutzbar
252,0 GB
Speicherbandbreite
7.100 GB/s
Rechenschnittstelle
CUDA