Apple MacBook Air 13 Zoll (2024), M3 mit 10-Kern-GPU, 8 GB

Ja. Auf diesem Gerät läuft Gemma 4 E2B flüssig, mit rund 23 bis 31 Token pro Sekunde.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Wofür möchten Sie das Gerät nutzen?

Größtes Modell, das flüssig läuft

Gemma 4 E2B

Q4_K_M · 23 bis 31 Token/s

So starten Sie es mit Ollama:

$ ollama run hf.co/unsloth/gemma-4-E2B-it-GGUF:Q4_K_M

Schnellstes Modell

LFM2.5 2.6B

Q4_K_M · 39 bis 54 Token/s

Das schnellste unter den flüssig laufenden Modellen mit mindestens halb so vielen Parametern wie das größte.

So starten Sie es mit Ollama:

$ ollama run hf.co/LiquidAI/LFM2.5-2.6B-GGUF:Q4_K_M

Modelle auf diesem Gerät

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

ModellUrteilTempoSpeicher
Gemma 4 E2B
Q4_K_M
Läuft gut23 bis 31 Token/s4,0 von 5,3 GB
Qwen3.5 4B
Q4_K_M
Läuft gut25 bis 35 Token/s3,7 von 5,3 GB
Qwen3 4B
Q4_K_M
Läuft gut25 bis 35 Token/s4,0 von 5,3 GB
LFM2.5 2.6B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft gut39 bis 54 Token/s2,8 von 5,3 GB
Gemma 4 E4B
Q4_0
Läuft nicht5,6 von 5,3 GB
Llama 3.1 8B
Q4_K_M
Läuft nicht6,4 von 5,3 GB
Qwen3 8B
Q4_K_M
Läuft nicht6,5 von 5,3 GB
Qwen3.5 9B
Q4_K_M
Läuft nicht6,7 von 5,3 GB
Ornith 1.5 9B
Q4_K_M
Läuft nicht6,9 von 5,3 GB
LFM2.5 8B A1B
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft nicht6,9 von 5,3 GB
Gemma 4 12B
Q4_0
Läuft nicht8,3 von 5,3 GB
Ministral 3 14B
Q4_K_M
Läuft nicht9,9 von 5,3 GB
Qwen3 14B
Q4_K_M
Läuft nicht10,7 von 5,3 GB
gpt-oss 20B
Q4_K_M
Läuft nicht12,8 von 5,3 GB
Mistral Small 3.2 24B
Q4_K_M
Läuft nicht16,1 von 5,3 GB
Qwen3.8 27B
Q4_K_M
Läuft nicht17,9 von 5,3 GB
Qwen3.6 27B
Q4_K_M
Läuft nicht18,2 von 5,3 GB
Gemma 4 26B A4B
Q4_K_M
Läuft nicht18,4 von 5,3 GB
Granite 4.2 30B
Q4_K_M
Läuft nicht20,0 von 5,3 GB
Qwen3 30B A3B 2507
Q4_K_M
Läuft nicht20,1 von 5,3 GB
Qwen3-Coder 30B A3B
Q4_K_M
Läuft nicht20,1 von 5,3 GB
Gemma 4 31B
Q4_K_M
Läuft nicht20,7 von 5,3 GB
Ornith 1.5 35B A3B
Q4_K_M
Läuft nicht23,0 von 5,3 GB
Qwen3.6 35B A3B
Q4_K_M
Läuft nicht23,5 von 5,3 GB
Llama 3.3 70B
Q4_K_M
Läuft nicht45,5 von 5,3 GB
gpt-oss 120B
Q4_K_M
Läuft nicht65,0 von 5,3 GB
Qwen3.5 122B A10B
Q4_K_M
Läuft nicht79,0 von 5,3 GB
Laguna S 2.1
Q4_K_M
Der Speicher für den Kontext ist geschätzt.
Läuft nicht110,8 von 5,3 GB
Ornith 1.5 397B
Q4_K_M
Läuft nicht250,1 von 5,3 GB
GLM-5.3 Flash
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht381,5 von 5,3 GB
GLM-5.3
Q8_0
Der Speicher für den Kontext ist geschätzt.
Läuft nicht895,4 von 5,3 GB

Gerätedaten

Chip
M3, 10-Kern-GPU
Arbeitsspeicher
8 GB
Davon für Modelle nutzbar
5,3 GB
Speicherbandbreite
100 GB/s
Rechenschnittstelle
Metal