Lokale KI zum Programmieren
Beim Programmieren liest ein Modell ganze Dateien und Fehlermeldungen mit; wir rechnen deshalb mit 16.384 Token Kontext. Zuerst stehen die Modelle, deren Anbieter sie ausdrücklich für Code gebaut hat, mit dem Zitat aus der Modellkarte. Darunter alle Modelle für diesen Kontext und Geräte mit Angebot, nach Preis sortiert.
Gerechnet mit 16.384 Token Kontext, der Annahme für diesen Einsatzzweck. Speicherbedarf und Tempo sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf jedem Gerät gemessen.
Modelle, die der Anbieter dafür nennt
Nur Modelle, deren Modellkarte diesen Zweck ausdrücklich nennt. Das Zitat steht daneben, mit Quelle und Lesedatum; es ist eine Selbstaussage des Anbieters, kein Urteil von uns.
Dafür gebaut
Qwen3-Coder 30B A3BAlibaba (Qwen)
„Significant Performance among open models on Agentic Coding, Agentic Browser-Use, and other foundational coding tasks.“
Quelle: huggingface.co, gelesen am 21. September 2026
Läuft flüssig auf 202 von 527 Geräten · ab 24 GB Speicher · ab 2.349 € mit ASUS ROG Flow Z13 (2025), Ryzen AI Max+ 395 mit Radeon 8060S, 32 GB
Dafür gebaut
Laguna XS 2.1poolside
„Laguna XS 2.1 is a 33B total parameter Mixture-of-Experts model with 3B activated parameters per token designed for agentic coding and long-horizon work on a local machine.“
Quelle: huggingface.co, gelesen am 21. September 2026
Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB
Dafür gebaut
Laguna S 2.1poolside
„Laguna S 2.1 is a 118B total parameter Mixture-of-Experts model with 8B activated parameters per token, designed for agentic coding and long-horizon work.“
Quelle: huggingface.co, gelesen am 21. September 2026
Läuft flüssig auf 13 von 527 Geräten · ab 256 GB Speicher
Geeignet
MiniCPM5 2BOpenBMB
„It is designed for local assistants, coding agents, tool-use workflows, and reasoning scenarios where a compact model is preferred.“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft flüssig auf 527 von 527 Geräten · ab 8 GB Speicher · ab 689 € mit Apple MacBook Neo 13 Zoll (2026), A18 Pro mit 5-Kern-GPU, 8 GB
Geeignet
Granite 4.2 30BIBM
„Reasoning, Code Generation, Tool Calling, Agentic Workflows, Multilingual Dialog“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft flüssig auf 192 von 527 Geräten · ab 24 GB Speicher · ab 2.349 € mit ASUS ROG Flow Z13 (2025), Ryzen AI Max+ 395 mit Radeon 8060S, 32 GB
Geeignet
Qwen3.6 35B A3BAlibaba (Qwen)
„This release delivers substantial upgrades, particularly in Agentic Coding: the model now handles frontend workflows and repository-level reasoning with greater fluency and precision.“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB
Geeignet
Nex-N2.5 miniNex-AGI
„The models can operate computers and browsers, as well as autonomously execute and test programs.“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB
Geeignet
Nex-N2.5 ProNex-AGI
„The models can operate computers and browsers, as well as autonomously execute and test programs.“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft flüssig auf 2 von 527 Geräten · ab 512 GB Speicher
Geeignet
Inkling SmallThinking Machines
„The model is designed to be used by developers building AI-powered applications, including agentic and tool-use systems, coding assistants, chatbots, and retrieval-augmented generation systems, and is suitable for general-purpose conversational use, instruction-following, and other natural language and multimodal tasks.“
Quelle: huggingface.co, gelesen am 21. September 2026
Läuft auf keinem geführten Gerät flüssig
Geeignet
GLM-5.3Z.ai
„GLM-5.3 is the most capable open-weights model for coding, with a 50% improvement over GLM-5.2 on our in-house Z.ai Code Bench.“
Quelle: huggingface.co, gelesen am 23. September 2026
Läuft auf keinem geführten Gerät flüssig
Geeignet
InklingThinking Machines
„The model is designed to be used by developers building AI-powered applications, including agentic and tool-use systems, coding assistants, chatbots, and retrieval-augmented generation systems, and is suitable for general-purpose conversational use, instruction-following, and other natural language and multimodal tasks.“
Quelle: huggingface.co, gelesen am 21. September 2026
Läuft auf keinem geführten Gerät flüssig
Alle Modelle für diesen Einsatzzweck
Zuerst die vom Anbieter für den Zweck genannten Modelle, dann alle anderen nach Speicherbedarf. „Ab Speicher“ ist der kleinste Arbeits- bzw. Grafikspeicher, auf dem das Modell flüssig läuft.
Geräte nach Preis
Geräte mit aktuellem Angebot aus den Händler-Feeds, günstigstes zuerst, mit dem Modell, das darauf für diesen Zweck flüssig läuft. Die Angebote selbst stehen als Partnerlinks auf der Geräteseite.