gpt-oss 120B

gpt-oss 120B braucht mit der Variante Q4_K_M rund 65,0 GB Speicher und läuft auf 69 von 527 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Apple Mac Studio (2026), M5 Ultra mit 64-Kern-GPU, 96 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Anbieter
OpenAI
Parameter
116,8 Mrd., davon 5,1 Mrd. aktiv
Längster Kontext
131.072 Token
Lizenz
apache-2.0

So starten Sie es mit Ollama:

$ ollama run gpt-oss:120b

Geräte, auf denen es flüssig läuft

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
Apple Mac Studio (2026), M5 Ultra mit 64-Kern-GPU, 96 GBLäuft gut84 bis 123 Token/s96 GB
davon 72,0 GB nutzbar
Apple Mac Studio (2026), M5 Ultra mit 80-Kern-GPU, 96 GBLäuft gut84 bis 123 Token/s96 GB
davon 72,0 GB nutzbar
Apple Mac Studio (2025), M3 Ultra mit 80-Kern-GPU, 96 GBLäuft gut70 bis 102 Token/s96 GB
davon 72,0 GB nutzbar
Apple Mac Studio (2025), M3 Ultra mit 60-Kern-GPU, 96 GBLäuft gut70 bis 102 Token/s96 GB
davon 72,0 GB nutzbar
Apple MacBook Pro 14 Zoll (2023), M2 Max mit 38-Kern-GPU, 96 GBLäuft gut45 bis 66 Token/s96 GB
davon 72,0 GB nutzbar
Apple MacBook Pro 16 Zoll (2023), M2 Max mit 38-Kern-GPU, 96 GBLäuft gut45 bis 66 Token/s96 GB
davon 72,0 GB nutzbar
Apple Mac Studio (2023), M2 Max mit 38-Kern-GPU, 96 GBLäuft gut45 bis 66 Token/s96 GB
davon 72,0 GB nutzbar
Apple MacBook Pro 14 Zoll (2023), M3 Max mit 30-Kern-GPU, 96 GBLäuft gut36 bis 54 Token/s96 GB
davon 72,0 GB nutzbar
Apple MacBook Pro 16 Zoll (2023), M3 Max mit 30-Kern-GPU, 96 GBLäuft gut36 bis 54 Token/s96 GB
davon 72,0 GB nutzbar
GMKtec EVO-X2 (2025), Ryzen AI Max+ 395 mit Radeon 8060S, 96 GBLäuft gut33 bis 56 Token/s96 GB
davon 72,0 GB nutzbar

und 59 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA RTX PRO 6000 Blackwell, 96 GBLäuft gut155 bis 232 Token/s96 GB
davon 95,2 GB nutzbar

Alle Geräte und Grafikkarten für gpt-oss 120B

Varianten

VarianteDateiSpeicherbedarfStartbefehl
Q4_062,6 GB64,8 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q3_K_M62,6 GB64,8 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q4_K_M62,8 GB65,0 GBollama run gpt-oss:120b
Q5_K_M62,9 GB65,1 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q6_K63,3 GB65,5 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q8_063,4 GB65,6 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.

Quelle: https://huggingface.co/unsloth/gpt-oss-120b-GGUF