Ornith 1.5 35B A3B

Ornith 1.5 35B A3B braucht mit der Variante Q4_K_M rund 23,0 GB Speicher und läuft auf 202 von 527 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5090 Laptop GPU, 32 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Anbieter
Ornith AI
Parameter
35,5 Mrd., davon 3 Mrd. aktiv
Längster Kontext
262.144 Token
Lizenz
mit

So starten Sie es mit Ollama:

$ ollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:Q4_K_M

Geräte, auf denen es flüssig läuft

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5090 Laptop GPU, 32 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5090 Laptop GPU, 64 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2026), GeForce RTX 5090 Laptop GPU, 64 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2026), GeForce RTX 5090 Laptop GPU, 128 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 16 (2025), GeForce RTX 5090 Laptop GPU, 32 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 16 (2025), GeForce RTX 5090 Laptop GPU, 64 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
ASUS ROG Strix SCAR 18 (2025), GeForce RTX 5090 Laptop GPU, 16 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
Razer Blade 18 (2026), GeForce RTX 5090 Laptop GPU, 32 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
Razer Blade 18 (2026), GeForce RTX 5090 Laptop GPU, 64 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar
HP OMEN MAX 16 (2025), GeForce RTX 5090 Laptop GPU, 32 GBLäuft gut173 bis 260 Token/s *24 GB
davon 23,2 GB nutzbar

und 192 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
AMD Radeon RX 7900 XTX, 24 GBLäuft gut254 bis 442 Token/s *24 GB
davon 23,2 GB nutzbar
NVIDIA GeForce RTX 4090, 24 GBLäuft gut186 bis 279 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA GeForce RTX 3090 Ti, 24 GBLäuft gut186 bis 279 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA GeForce RTX 3090, 24 GBLäuft gut178 bis 267 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA RTX A5000, 24 GBLäuft gut157 bis 236 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA RTX PRO 4000 Blackwell, 24 GBLäuft gut144 bis 216 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA RTX 4500 Ada Generation, 24 GBLäuft gut104 bis 157 Token/s24 GB
davon 23,2 GB nutzbar
NVIDIA GeForce RTX 5090, 32 GBLäuft gut249 bis 374 Token/s32 GB
davon 31,2 GB nutzbar
AMD Radeon AI PRO R9700, 32 GBLäuft gut180 bis 313 Token/s *32 GB
davon 31,2 GB nutzbar
AMD Radeon PRO W7800, 32 GBLäuft gut163 bis 283 Token/s *32 GB
davon 31,2 GB nutzbar

und 7 weitere

Alle Geräte und Grafikkarten für Ornith 1.5 35B A3B

Varianten

VarianteDateiSpeicherbedarfStartbefehl
Q4_K_M21,7 GB23,0 GBollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:Q4_K_M
Q5_K_M25,3 GB26,7 GBollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:Q5_K_M
Q6_K29,2 GB30,7 GBollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:Q6_K
Q8_037,8 GB39,5 GBollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:Q8_0
BF1671,1 GB73,4 GBollama run hf.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF:BF16

Quelle: https://huggingface.co/ornith-ai/Ornith-1.5-35B-A3B-GGUF