LFM2.5 230M

LFM2.5 230M braucht mit der Variante Q4_K_M rund 1,0 GB Speicher und läuft auf allen 527 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Anbieter
Liquid AI
Parameter
0,2 Mrd.
Längster Kontext
128.000 Token
Nimmt entgegen
Text
Lizenz
other

So starten Sie es mit Ollama:

$ ollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q4_K_M

Für mehrere Nutzer gleichzeitig: Ollama bedient dieses Modell immer nur mit einer Anfrage nach der anderen. Bei anderen Modellen lässt sich das über die Einstellung OLLAMA_NUM_PARALLEL ändern, hier nicht: Ollama setzt den Wert für diese Modellart selbst zurück. Die Tempoangaben oben gelten für eine einzelne Anfrage.

Geräte, auf denen es flüssig läuft

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 64 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 16 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 32 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 64 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 32 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 64 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 16 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 32 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 64 GBLäuft gut1.592 bis 1.946 Token/s *8 GB
davon 7,2 GB nutzbar

und 517 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA GeForce RTX 3070 Ti, 8 GBLäuft gut2.453 bis 2.998 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060, 8 GBLäuft gut1.843 bis 2.252 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060 Ti, 8 GBLäuft gut1.843 bis 2.252 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3060 Ti, 8 GBLäuft gut1.843 bis 2.252 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3070, 8 GBLäuft gut1.843 bis 2.252 Token/s8 GB
davon 7,2 GB nutzbar
AMD Radeon RX 9060 XT, 8 GBLäuft gut1.088 bis 1.935 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060 Ti, 8 GBLäuft gut1.209 bis 1.478 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060, 8 GBLäuft gut1.144 bis 1.398 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3080, 10 GBLäuft gut3.010 bis 3.678 Token/s10 GB
davon 9,2 GB nutzbar
Intel Arc B570, 10 GBLäuft gut1.272 bis 2.261 Token/s10 GB
davon 9,2 GB nutzbar

und 50 weitere

Alle Geräte und Grafikkarten für LFM2.5 230M

Varianten

VarianteDateiSpeicherbedarfStartbefehl
Q4_00,1 GB1,0 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q4_0
Q4_K_M0,2 GB1,0 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q4_K_M
Q5_K_M0,2 GB1,0 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q5_K_M
Q6_K0,2 GB1,0 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q6_K
Q8_00,2 GB1,1 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:Q8_0
BF160,5 GB1,3 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:BF16
F160,5 GB1,3 GBollama run hf.co/LiquidAI/LFM2.5-230M-GGUF:F16

Quelle: https://huggingface.co/LiquidAI/LFM2.5-230M-GGUF

Weitere Ratgeber