Nex-N2.5-mini

Dieses Modell ist aus seiner Modellkarte automatisch übernommen und von uns noch nicht gegengelesen; Größen, Kontext und Lizenz sind gemessen, die Einordnung nicht.

Nex-N2.5-mini braucht mit der Variante Q4_K_M rund 24,5 GB Speicher und läuft auf 72 von 527 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Apple MacBook Pro 14 Zoll (2026), M5 Max mit 40-Kern-GPU, 48 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Anbieter
nex-agi
Parameter
34,7 Mrd.
Längster Kontext
262.144 Token
Nimmt entgegen
Text und Bilder
Lizenz
Apache 2.0

So starten Sie es mit Ollama:

$ ollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q4_K_M
>>> /set parameter num_ctx 4096

Ab 24 GB Grafikspeicher (beim Mac ab 36 GB Arbeitsspeicher) wählt Ollama von selbst mehr Kontext und braucht dann mehr Speicher. Die zweite Zeile, nach dem Start in Ollama eingegeben, hält den Kontext bei den 4.096 Token, für die die Zahlen hier gelten.

Für mehrere Nutzer gleichzeitig: Ollama bedient dieses Modell immer nur mit einer Anfrage nach der anderen. Bei anderen Modellen lässt sich das über die Einstellung OLLAMA_NUM_PARALLEL ändern, hier nicht: Ollama setzt den Wert für diese Modellart selbst zurück. Die Tempoangaben oben gelten für eine einzelne Anfrage.

Geräte, auf denen es flüssig läuft

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
Apple MacBook Pro 14 Zoll (2026), M5 Max mit 40-Kern-GPU, 48 GBLäuft gut13 bis 18 Token/s48 GB
davon 36,0 GB nutzbar
Apple MacBook Pro 16 Zoll (2026), M5 Max mit 40-Kern-GPU, 48 GBLäuft gut13 bis 18 Token/s48 GB
davon 36,0 GB nutzbar
Apple Mac Studio (2026), M5 Max mit 40-Kern-GPU, 48 GBLäuft gut13 bis 18 Token/s48 GB
davon 36,0 GB nutzbar
Apple MacBook Pro 14 Zoll (2024), M4 Max mit 40-Kern-GPU, 48 GBLäuft gut12 bis 16 Token/s48 GB
davon 36,0 GB nutzbar
Apple MacBook Pro 16 Zoll (2024), M4 Max mit 40-Kern-GPU, 48 GBLäuft gut12 bis 16 Token/s48 GB
davon 36,0 GB nutzbar
Apple Mac Studio (2025), M4 Max mit 40-Kern-GPU, 48 GBLäuft gut12 bis 16 Token/s48 GB
davon 36,0 GB nutzbar
Apple MacBook Pro 14 Zoll (2023), M3 Max mit 40-Kern-GPU, 48 GBLäuft gut9,7 bis 13 Token/s48 GB
davon 36,0 GB nutzbar
Apple MacBook Pro 16 Zoll (2023), M3 Max mit 40-Kern-GPU, 48 GBLäuft gut9,7 bis 13 Token/s48 GB
davon 36,0 GB nutzbar
Apple Mac Studio (2022), M1 Ultra mit 64-Kern-GPU, 64 GBLäuft gut15 bis 20 Token/s64 GB
davon 48,0 GB nutzbar
Apple Mac Studio (2023), M2 Ultra mit 60-Kern-GPU, 64 GBLäuft gut15 bis 20 Token/s64 GB
davon 48,0 GB nutzbar

und 62 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA GeForce RTX 5090, 32 GBLäuft gut46 bis 56 Token/s32 GB
davon 31,2 GB nutzbar
NVIDIA RTX PRO 4500 Blackwell, 32 GBLäuft gut25 bis 31 Token/s32 GB
davon 31,2 GB nutzbar
AMD Radeon AI PRO R9700, 32 GBLäuft gut15 bis 28 Token/s32 GB
davon 31,2 GB nutzbar
AMD Radeon PRO W7800, 32 GBLäuft gut13 bis 25 Token/s32 GB
davon 31,2 GB nutzbar
NVIDIA RTX 5000 Ada Generation, 32 GBLäuft gut17 bis 21 Token/s32 GB
davon 31,2 GB nutzbar
NVIDIA RTX PRO 5000 Blackwell, 48 GBLäuft gut36 bis 44 Token/s48 GB
davon 47,2 GB nutzbar
NVIDIA RTX 6000 Ada Generation, 48 GBLäuft gut27 bis 33 Token/s48 GB
davon 47,2 GB nutzbar
AMD Radeon PRO W7900, 48 GBLäuft gut19 bis 36 Token/s48 GB
davon 47,2 GB nutzbar
NVIDIA RTX A6000, 48 GBLäuft gut22 bis 27 Token/s48 GB
davon 47,2 GB nutzbar
NVIDIA RTX PRO 6000 Blackwell, 96 GBLäuft gut46 bis 56 Token/s96 GB
davon 95,2 GB nutzbar

Alle Geräte und Grafikkarten für Nex-N2.5-mini

Varianten

Der Bedarf gilt für 4.096 Token Kontext. Dabei bleibt Ollama, wenn Sie nach dem Start „/set parameter num_ctx 4096“ eingeben.

VarianteDateiSpeicherbedarfStartbefehl
Q3_K_M17,3 GB19,5 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q3_K_M
Q4_019,9 GB22,1 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q4_0
Q4_K_M22,3 GB24,5 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q4_K_M
Q5_K_M27,0 GB29,3 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q5_K_M
Q6_K29,4 GB31,7 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q6_K
Q8_036,9 GB39,4 GBollama run hf.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF:Q8_0
BF1669,4 GB71,6 GBIn mehrere Dateien aufgeteilt, mit Ollama nicht direkt startbar.

Quelle: https://huggingface.co/bartowski/nex-agi_Nex-N2.5-mini-GGUF

Weitere Ratgeber