LFM2.5-VL-1.6B

Dieses Modell ist aus seiner Modellkarte automatisch übernommen und von uns noch nicht gegengelesen; Größen, Kontext und Lizenz sind gemessen, die Einordnung nicht.

LFM2.5-VL-1.6B braucht mit der Variante Q4_K_M rund 2,2 GB Speicher und läuft auf allen 544 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten und eigenen Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Wofür möchten Sie das Modell nutzen?
Mehr zu diesem Einsatzzweck: Modelle und Geräte nach Preis
Anbieter
LiquidAI
Parameter
1,2 Mrd.
Längster Kontext
128.000 Token
Nimmt entgegen
Text und Bilder
Lizenz
eigene Lizenz des AnbietersOb die Lizenz den Einsatz im Unternehmen erlaubt, haben wir noch nicht geprüft.

So starten Sie es mit Ollama:

$ ollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q4_K_M
>>> /set parameter num_ctx 4096

Ab 24 GB Grafikspeicher wählt Ollama von selbst mehr Kontext und braucht dann mehr Speicher; beim Mac zählt dabei der Teil des Arbeitsspeichers, den macOS der Grafik zuteilt. Die zweite Zeile, nach dem Start in Ollama eingegeben, hält den Kontext bei den 4.096 Token, für die die Zahlen hier gelten.

Für mehrere Nutzer gleichzeitig: Ollama bedient dieses Modell immer nur mit einer Anfrage nach der anderen. Bei anderen Modellen lässt sich das über die Einstellung OLLAMA_NUM_PARALLEL ändern, hier nicht: Ollama setzt den Wert für diese Modellart selbst zurück. Die Tempoangaben oben gelten für eine einzelne Anfrage.

Geräte, auf denen es flüssig läuft

Die Tempowerte sind berechnet, nicht auf dem Gerät gemessen, und an veröffentlichten und eigenen Messungen abgeglichen. Ausgenommen sind die mit * markierten Werte: sie sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 64 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 16 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 32 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 64 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 32 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 64 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 16 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 32 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 64 GBLäuft gut332 bis 405 Token/s *8 GB
davon 7,2 GB nutzbar

und 534 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA GeForce RTX 3070 Ti, 8 GBLäuft gut510 bis 623 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060, 8 GBLäuft gut384 bis 469 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060 Ti, 8 GBLäuft gut384 bis 469 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3060 Ti, 8 GBLäuft gut384 bis 469 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3070, 8 GBLäuft gut384 bis 469 Token/s8 GB
davon 7,2 GB nutzbar
AMD Radeon RX 9060 XT, 8 GBLäuft gut224 bis 416 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060 Ti, 8 GBLäuft gut252 bis 308 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060, 8 GBLäuft gut238 bis 291 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3080, 10 GBLäuft gut625 bis 764 Token/s10 GB
davon 9,2 GB nutzbar
Intel Arc B570, 10 GBLäuft gut261 bis 485 Token/s10 GB
davon 9,2 GB nutzbar

und 50 weitere

Alle Geräte und Grafikkarten für LFM2.5-VL-1.6B

Varianten

Der Bedarf gilt für 4.096 Token Kontext. Dabei bleibt Ollama, wenn Sie nach dem Start „/set parameter num_ctx 4096“ eingeben.

VarianteDateiSpeicherbedarfStartbefehl
Q4_00,7 GB2,2 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q4_0
Q4_K_M0,7 GB2,2 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q4_K_M
Q5_K_M0,8 GB2,4 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q5_K_M
Q6_K1,0 GB2,5 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q6_K
Q8_01,2 GB2,8 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:Q8_0
BF162,3 GB4,2 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:BF16
F162,3 GB4,2 GBollama run hf.co/LiquidAI/LFM2.5-VL-1.6B-GGUF:F16

Quelle: https://huggingface.co/LiquidAI/LFM2.5-VL-1.6B-GGUF

Weitere Ratgeber