MiniCPM5-1B

Dieses Modell ist aus seiner Modellkarte automatisch übernommen und von uns noch nicht gegengelesen; Größen, Kontext und Lizenz sind gemessen, die Einordnung nicht.

MiniCPM5-1B braucht mit der Variante Q4_K_M rund 1,6 GB Speicher und läuft auf allen 561 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: HP ZBook 8 G2i 16 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 48 GB. Die letzte Zahl im Namen ist der Arbeitsspeicher; der Grafikspeicher beträgt 6 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf diesem Gerät gemessen. Ausgenommen sind Werte mit dem Zusatz „nicht an Messungen abgeglichen“: für sie fehlt der Abgleich, sie sind unsicher.

Wofür möchten Sie das Modell nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis
Anbieter
openbmb
Parameter
1,1 Mrd.
Längster Kontext
131.072 Token
Nimmt entgegen
Text
Lizenz
Apache 2.0

So starten Sie es mit Ollama:

$ ollama run hf.co/openbmb/MiniCPM5-1B-GGUF:Q4_K_M
>>> /set parameter num_ctx 4096

Ab 24 GB Grafikspeicher wählt Ollama von selbst mehr Kontext und braucht dann mehr Speicher; beim Mac zählt dabei der Teil des Arbeitsspeichers, den macOS der Grafik zuteilt. Die zweite Zeile, nach dem Start in Ollama eingegeben, hält den Kontext bei den 4.096 Token, für die die Zahlen hier gelten.

Oder mit llama.cpp, mit dem Kontext dieser Seite (lädt das Modell von Hugging Face):

$ llama-server -hf openbmb/MiniCPM5-1B-GGUF:Q4_K_M -c 4096

Geräte, auf denen es flüssig läuft

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
HP ZBook 8 G2i 16 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 48 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
HP ZBook 8 G2i 16 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 32 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
Lenovo ThinkPad P14s 14,5 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 32 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
Lenovo ThinkPad P14s 14,5 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 64 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
HP ZBook 8 G2i 14 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 32 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
HP ZBook 8 G2i 14 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 48 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
HP ZBook 8 G2i 14 Zoll (2026), RTX PRO 500 Blackwell Laptop GPU, 64 GBLäuft gut270 bis 330 Token/s *6 GB
davon 5,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GBLäuft gut355 bis 434 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 64 GBLäuft gut355 bis 434 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 16 GBLäuft gut355 bis 434 Token/s *8 GB
davon 7,2 GB nutzbar

und 551 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
AMD Radeon RX 5500 XT, 4 GBLäuft gut170 bis 303 Token/s *4 GB
davon 3,2 GB nutzbar
NVIDIA GeForce GTX 1650 SUPER, 4 GBLäuft gut182 bis 223 Token/s *4 GB
davon 3,2 GB nutzbar
NVIDIA T1000, 4 GBLäuft gut153 bis 187 Token/s4 GB
davon 3,2 GB nutzbar
NVIDIA T600, 4 GBLäuft gut153 bis 187 Token/s4 GB
davon 3,2 GB nutzbar
AMD Radeon RX 6500 XT, 4 GBLäuft gut110 bis 195 Token/s4 GB
davon 3,2 GB nutzbar
AMD Radeon PRO W6400, 4 GBLäuft gut99 bis 173 Token/s4 GB
davon 3,2 GB nutzbar
AMD Radeon RX 6400, 4 GBLäuft gut99 bis 173 Token/s4 GB
davon 3,2 GB nutzbar
Intel Arc A310, 4 GBLäuft gut96 bis 168 Token/s4 GB
davon 3,2 GB nutzbar
NVIDIA GeForce GTX 1650, 4 GBLäuft gut123 bis 150 Token/s *4 GB
davon 3,2 GB nutzbar
NVIDIA RTX A400, 4 GBLäuft gut92 bis 113 Token/s4 GB
davon 3,2 GB nutzbar

und 105 weitere

Alle Geräte und Grafikkarten für MiniCPM5-1B

Varianten

Der Bedarf gilt für 4.096 Token Kontext. Dabei bleibt Ollama, wenn Sie nach dem Start „/set parameter num_ctx 4096“ eingeben.

VarianteDateiSpeicherbedarfStartbefehl
Q4_K_M0,7 GB1,6 GBollama run hf.co/openbmb/MiniCPM5-1B-GGUF:Q4_K_M
Q8_01,2 GB2,1 GBollama run hf.co/openbmb/MiniCPM5-1B-GGUF:Q8_0
F162,2 GB3,1 GBollama run hf.co/openbmb/MiniCPM5-1B-GGUF:F16

Quelle: https://huggingface.co/openbmb/MiniCPM5-1B-GGUF

Weitere Ratgeber