Acer Veriton GN100 AI Mini Workstation (2025), NVIDIA GB10 mit Blackwell-GPU, 128 GB

Ja. Auf diesem Gerät läuft Qwen3.5 122B A10B flüssig, mit rund 22 bis 32 Token pro Sekunde.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Wofür möchten Sie das Gerät nutzen?

Größtes Modell, das flüssig läuft

Qwen3.5 122B A10B

Q4_K_M · 22 bis 32 Token/s

Schnellstes Modell

gpt-oss 120B

Q4_K_M · 47 bis 71 Token/s

Das schnellste unter den flüssig laufenden Modellen mit mindestens halb so vielen Parametern wie das größte.

So starten Sie es mit Ollama:

$ ollama run gpt-oss:120b

Modelle auf diesem Gerät

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

ModellUrteilTempoSpeicher
Qwen3.5 122B A10B
Q4_K_M
Läuft gut22 bis 32 Token/s79,0 von 96,0 GB
Gemma 4 31B
Q4_K_M
Läuft gut9,8 bis 12 Token/s20,7 von 96,0 GB
Granite 4.2 30B
Q4_K_M
Läuft gut10 bis 13 Token/s20,0 von 96,0 GB
Qwen3.8 27B
Q4_K_M
Läuft gut11 bis 14 Token/s17,9 von 96,0 GB
Qwen3.6 27B
Q4_K_M
Läuft gut11 bis 14 Token/s18,2 von 96,0 GB
gpt-oss 120B
Q4_K_M
Läuft gut47 bis 71 Token/s65,0 von 96,0 GB
Mistral Small 3.2 24B
Q4_K_M
Läuft gut13 bis 16 Token/s16,1 von 96,0 GB
Qwen3 14B
Q4_K_M
Läuft gut20 bis 25 Token/s10,7 von 96,0 GB
Ministral 3 14B
Q4_K_M
Läuft gut22 bis 27 Token/s9,9 von 96,0 GB
Gemma 4 12B
Q4_0
Läuft gut26 bis 31 Token/s8,3 von 96,0 GB
Ornith 1.5 35B A3B
Q4_K_M
Läuft gut72 bis 108 Token/s23,0 von 96,0 GB
Qwen3.6 35B A3B
Q4_K_M
Läuft gut70 bis 105 Token/s23,5 von 96,0 GB
Qwen3 30B A3B 2507
Q4_K_M
Läuft gut62 bis 93 Token/s20,1 von 96,0 GB
Qwen3-Coder 30B A3B
Q4_K_M
Läuft gut62 bis 93 Token/s20,1 von 96,0 GB
Gemma 4 26B A4B
Q4_K_M
Läuft gut50 bis 74 Token/s18,4 von 96,0 GB
Ornith 1.5 9B
Q4_K_M
Läuft gut32 bis 39 Token/s6,9 von 96,0 GB
Qwen3.5 9B
Q4_K_M
Läuft gut33 bis 40 Token/s6,7 von 96,0 GB
gpt-oss 20B
Q4_K_M
Läuft gut65 bis 98 Token/s12,8 von 96,0 GB
Qwen3 8B
Q4_K_M
Läuft gut35 bis 43 Token/s6,5 von 96,0 GB
Llama 3.1 8B
Q4_K_M
Läuft gut36 bis 45 Token/s6,4 von 96,0 GB
Gemma 4 E4B
Q4_0
Läuft gut41 bis 50 Token/s5,6 von 96,0 GB
Gemma 4 E2B
Q4_K_M
Läuft gut61 bis 74 Token/s4,0 von 96,0 GB
Qwen3.5 4B
Q4_K_M
Läuft gut67 bis 82 Token/s3,7 von 96,0 GB
Qwen3 4B
Q4_K_M
Läuft gut68 bis 83 Token/s4,0 von 96,0 GB
LFM2.5 8B A1B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut106 bis 159 Token/s6,9 von 96,0 GB
LFM2.5 2.6B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut104 bis 128 Token/s2,8 von 96,0 GB
Llama 3.3 70B
Q4_K_M
Läuft, aber mit rund 4,8 Token pro Sekunde spürbar langsam.
Eingeschränkt4,4 bis 5,3 Token/s45,5 von 96,0 GB
Laguna S 2.1
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft nicht110,8 von 96,0 GB
Ornith 1.5 397B
Q4_K_M
Läuft nicht250,1 von 96,0 GB
GLM-5.3 Flash
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht381,5 von 96,0 GB
GLM-5.3
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht895,4 von 96,0 GB

Gerätedaten

Chip
NVIDIA GB10, Blackwell-GPU
Arbeitsspeicher
128 GB
Davon für Modelle nutzbar
96,0 GB
Speicherbandbreite
273 GB/s
Rechenschnittstelle
CUDA