Teuken 7B

Teuken 7B braucht mit der Variante Q4_K_M rund 6,1 GB Speicher und läuft auf 509 von 527 geführten Geräten flüssig.

Mit dem wenigsten Speicher schafft es: Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GB.

Berechnet für 4.096 Token Kontext (Anwendungsfall „Ausprobieren, Neugier“). Die Tempowerte sind an veröffentlichten Messungen abgeglichen, aber nicht auf diesem Gerät gemessen.

Anbieter
OpenGPT-X
Parameter
7,5 Mrd.
Längster Kontext
4.096 Token
Deutsch
In der Modellkarte als Sprache genanntis an instruction-tuned 7B parameter multilingual large language model (LLM) pre-trained with 4T tokens in all official 24 European languages and released under Apache 2.0 in the research project [OpenGPT-X]“ (Quelle: huggingface.co, gelesen am 21. September 2026)
Lizenz
apache-2.0

So starten Sie es mit Ollama:

$ ollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q4_K_M

Geräte, auf denen es flüssig läuft

Alle Tempowerte sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf dem Gerät gemessen. Mit * markierte Werte sind nicht abgeglichen und deshalb unsicher.

GerätUrteilTempoSpeicher
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 32 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 1000 Blackwell Laptop GPU, 64 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 16 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 32 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
Lenovo ThinkPad P1 16 Zoll (2025), RTX PRO 2000 Blackwell Laptop GPU, 64 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 16 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 32 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5060 Laptop GPU, 64 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 16 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar
ASUS ROG Zephyrus G14 (2025), GeForce RTX 5070 Laptop GPU, 32 GBLäuft gut52 bis 63 Token/s *8 GB
davon 7,2 GB nutzbar

und 499 weitere

Grafikkarten, in die es ganz passt

GrafikkarteUrteilTempoSpeicher
NVIDIA GeForce RTX 3070 Ti, 8 GBLäuft gut79 bis 97 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3060 Ti, 8 GBLäuft gut60 bis 73 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3070, 8 GBLäuft gut60 bis 73 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060, 8 GBLäuft gut60 bis 73 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 5060 Ti, 8 GBLäuft gut60 bis 73 Token/s8 GB
davon 7,2 GB nutzbar
AMD Radeon RX 9060 XT, 8 GBLäuft gut35 bis 63 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060 Ti, 8 GBLäuft gut39 bis 48 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 4060, 8 GBLäuft gut37 bis 45 Token/s8 GB
davon 7,2 GB nutzbar
NVIDIA GeForce RTX 3080, 10 GBLäuft gut97 bis 119 Token/s10 GB
davon 9,2 GB nutzbar
Intel Arc B570, 10 GBLäuft gut41 bis 73 Token/s10 GB
davon 9,2 GB nutzbar

und 50 weitere

Alle Geräte und Grafikkarten für Teuken 7B

Varianten

VarianteDateiSpeicherbedarfStartbefehl
Q3_K_M4,1 GB5,2 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q3_K_M
Q4_K_M5,0 GB6,1 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q4_K_M
Q5_K_M5,7 GB6,7 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q5_K_M
Q6_K6,5 GB7,6 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q6_K
Q8_07,9 GB9,0 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:Q8_0
F1614,9 GB16,1 GBollama run hf.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF:F16

Quelle: https://huggingface.co/mradermacher/Teuken-7B-instruct-commercial-v0.4-GGUF

Weitere Ratgeber