Jebadiah 9B v2

Dieses Modell ist aus seiner Modellkarte automatisch übernommen und von uns noch nicht gegengelesen; Größen, Kontext und Lizenz sind gemessen, die Einordnung nicht.

Jebadiah 9B v2 braucht mit der Variante Q4_K_M rund 8,0 GB Speicher und läuft auf 408 von 558 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: ASUS ROG Strix G16 (2025), GeForce RTX 5070 Ti Laptop GPU, 16 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Wofür möchten Sie das Modell nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis
Anbieter
frontier-infra
Parameter
9,2 Mrd.
Längster Kontext
262.144 Token
Nimmt entgegen
Text und Bilder
Lizenz
Apache 2.0

So starten Sie es mit Ollama:

$ ollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q4_K_M
>>> /set parameter num_ctx 4096

Ab 24 GB Grafikspeicher wählt Ollama von selbst mehr Kontext und braucht dann mehr Speicher; beim Mac zählt dabei der Teil des Arbeitsspeichers, den macOS der Grafik zuteilt. Die zweite Zeile, nach dem Start in Ollama eingegeben, hält den Kontext bei den 4.096 Token, für die die Zahlen hier gelten.

Für mehrere Nutzer gleichzeitig: Ollama bedient dieses Modell immer nur mit einer Anfrage nach der anderen. Bei anderen Modellen lässt sich das über die Einstellung OLLAMA_NUM_PARALLEL ändern, hier nicht: Ollama setzt den Wert für diese Modellart selbst zurück. Die Tempoangaben oben gelten für eine einzelne Anfrage.

Geräte, auf denen es flüssig läuft

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
ASUS ROG Strix G16 (2025), GeForce RTX 5070 Ti Laptop GPU, 16 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix G16 (2025), GeForce RTX 5070 Ti Laptop GPU, 32 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix G18 (2025), GeForce RTX 5070 Ti Laptop GPU, 16 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix G18 (2025), GeForce RTX 5070 Ti Laptop GPU, 32 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix SCAR 16 (2025), GeForce RTX 5070 Ti Laptop GPU, 32 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix SCAR 16 (2025), GeForce RTX 5070 Ti Laptop GPU, 64 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Ti Laptop GPU, 32 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5070 Ti Laptop GPU, 16 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5070 Ti Laptop GPU, 32 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5070 Ti Laptop GPU, 64 GBLäuft gut73 bis 89 Token/s *12 GB
davon 11,2 GB nutzbar

und 398 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA GeForce RTX 3080, 10 GBLäuft gut81 bis 100 Token/s10 GB
davon 9,2 GB nutzbar
Intel Arc B570, 10 GBLäuft gut34 bis 63 Token/s10 GB
davon 9,2 GB nutzbar
AMD Radeon RX 6700, 10 GBLäuft gut29 bis 54 Token/s10 GB
davon 9,2 GB nutzbar
NVIDIA GeForce RTX 2080 Ti, 11 GBLäuft gut67 bis 82 Token/s *11 GB
davon 10,2 GB nutzbar
NVIDIA GeForce RTX 3080 Ti, 12 GBLäuft gut96 bis 117 Token/s12 GB
davon 11,2 GB nutzbar
NVIDIA GeForce RTX 3080, 12 GBLäuft gut96 bis 117 Token/s12 GB
davon 11,2 GB nutzbar
NVIDIA GeForce RTX 5070, 12 GBLäuft gut73 bis 89 Token/s12 GB
davon 11,2 GB nutzbar
NVIDIA GeForce RTX 4070 Ti, 12 GBLäuft gut56 bis 68 Token/s12 GB
davon 11,2 GB nutzbar
NVIDIA GeForce RTX 4070, 12 GBLäuft gut56 bis 68 Token/s12 GB
davon 11,2 GB nutzbar
NVIDIA GeForce RTX 4070 SUPER, 12 GBLäuft gut56 bis 68 Token/s12 GB
davon 11,2 GB nutzbar

und 55 weitere

Alle Geräte und Grafikkarten für Jebadiah 9B v2

Varianten

Der Bedarf gilt für 4.096 Token Kontext. Dabei bleibt Ollama, wenn Sie nach dem Start „/set parameter num_ctx 4096“ eingeben.

VarianteDateiSpeicherbedarfStartbefehl
Q3_K_M4,6 GB6,6 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q3_K_M
Q4_05,6 GB7,6 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q4_0
Q4_K_M6,0 GB8,0 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q4_K_M
Q5_K_M7,0 GB9,0 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q5_K_M
Q6_K7,9 GB10,0 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q6_K
Q8_09,8 GB11,9 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:Q8_0
BF1618,4 GB20,6 GBollama run hf.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF:BF16

Quelle: https://huggingface.co/bartowski/frontier-infra_jebadiah-9b-v2-GGUF

Weitere Ratgeber