Kolibri 1

Kolibri 1 braucht mit der Variante Q4_K_M rund 49,3 GB Speicher und läuft auf 81 von 640 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Dell XPS 14 14 Zoll (2026), Core Ultra Series 3 mit LPDDR5X-9600 (zweikanalig), 64 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf diesem Gerät gemessen. Ausgenommen sind Werte mit dem Zusatz „nicht an Messungen abgeglichen“: für sie fehlt der Abgleich, sie sind unsicher.

Wofür möchten Sie das Modell nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis
Anbieter
Aleph Alpha
Parameter
78,1 Mrd., davon 3,5 Mrd. aktiv
Längster Kontext
262.144 Token
Nimmt entgegen
Text
Deutsch
In der Modellkarte als Sprache genannt„Kolibri is Aleph Alpha's mixture-of-experts (MoE) reasoning model, with a focus on German and English.“ (Quelle: huggingface.co, gelesen am 5. Oktober 2026)
Lizenz
Apache 2.0

Läuft noch nicht in Ollama, LM Studio oder dem üblichen llama.cpp: llama.cpp kennt die Bauart von Kolibri noch nicht. Aleph Alpha liefert das Modell für vLLM; die GGUF-Dateien, aus denen wir Speicher und Tempo rechnen, stammen aus einer unabhängigen Umwandlung und brauchen einen Patch für llama.cpp. Deshalb steht hier kein Startbefehl, und wir empfehlen das Modell noch nicht. Zur Anfrage bei llama.cpp

Geräte, auf denen es flüssig läuft

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

und 71 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA RTX PRO 6000 Blackwell, 96 GBLäuft gut213 bis 340 Token/s96 GB
davon 95,2 GB nutzbar

Alle Geräte und Grafikkarten für Kolibri 1

Varianten

Der Bedarf gilt für 4.096 Token Kontext. Dabei bleibt Ollama, wenn Sie nach dem Start „/set parameter num_ctx 4096“ eingeben.

VarianteDateiSpeicherbedarfStartbefehl
Q4_K_M47,5 GB49,3 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q6_K64,2 GB66,4 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.
Q8_083,1 GB85,7 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.

Quelle: https://huggingface.co/Hob-forge/Kolibri-1-GGUF

Weitere Ratgeber