Lokale KI zum Programmieren

Beim Programmieren liest ein Modell ganze Dateien und Fehlermeldungen mit; wir rechnen deshalb mit 16.384 Token Kontext. Zuerst stehen die Modelle, deren Anbieter sie ausdrücklich für Code gebaut hat, mit dem Zitat aus der Modellkarte. Darunter alle Modelle für diesen Kontext und Geräte mit Angebot, nach Preis sortiert.

Gerechnet mit 16.384 Token Kontext, der Annahme für diesen Einsatzzweck. Speicherbedarf und Tempo sind berechnet und an veröffentlichten Messungen abgeglichen, nicht auf jedem Gerät gemessen.

Modelle, die der Anbieter dafür nennt

Nur Modelle, deren Modellkarte diesen Zweck ausdrücklich nennt. Das Zitat steht daneben, mit Quelle und Lesedatum; es ist eine Selbstaussage des Anbieters, kein Urteil von uns.

  • Dafür gebaut

    Qwen3-Coder 30B A3B

    Alibaba (Qwen)

    Significant Performance among open models on Agentic Coding, Agentic Browser-Use, and other foundational coding tasks.

    Quelle: huggingface.co, gelesen am 21. September 2026

    Läuft flüssig auf 202 von 527 Geräten · ab 24 GB Speicher · ab 2.349 € mit ASUS ROG Flow Z13 (2025), Ryzen AI Max+ 395 mit Radeon 8060S, 32 GB

  • Dafür gebaut

    Laguna XS 2.1

    poolside

    Laguna XS 2.1 is a 33B total parameter Mixture-of-Experts model with 3B activated parameters per token designed for agentic coding and long-horizon work on a local machine.

    Quelle: huggingface.co, gelesen am 21. September 2026

    Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB

  • Dafür gebaut

    Laguna S 2.1

    poolside

    Laguna S 2.1 is a 118B total parameter Mixture-of-Experts model with 8B activated parameters per token, designed for agentic coding and long-horizon work.

    Quelle: huggingface.co, gelesen am 21. September 2026

    Läuft flüssig auf 13 von 527 Geräten · ab 256 GB Speicher

  • Geeignet

    MiniCPM5 2B

    OpenBMB

    It is designed for local assistants, coding agents, tool-use workflows, and reasoning scenarios where a compact model is preferred.

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft flüssig auf 527 von 527 Geräten · ab 8 GB Speicher · ab 689 € mit Apple MacBook Neo 13 Zoll (2026), A18 Pro mit 5-Kern-GPU, 8 GB

  • Geeignet

    Granite 4.2 30B

    IBM

    Reasoning, Code Generation, Tool Calling, Agentic Workflows, Multilingual Dialog

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft flüssig auf 192 von 527 Geräten · ab 24 GB Speicher · ab 2.349 € mit ASUS ROG Flow Z13 (2025), Ryzen AI Max+ 395 mit Radeon 8060S, 32 GB

  • Geeignet

    Qwen3.6 35B A3B

    Alibaba (Qwen)

    This release delivers substantial upgrades, particularly in Agentic Coding: the model now handles frontend workflows and repository-level reasoning with greater fluency and precision.

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB

  • Geeignet

    Nex-N2.5 mini

    Nex-AGI

    The models can operate computers and browsers, as well as autonomously execute and test programs.

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft flüssig auf 138 von 527 Geräten · ab 48 GB Speicher · ab 3.439 € mit Apple MacBook Pro 16 Zoll (2026), M5 Pro mit 20-Kern-GPU, 48 GB

  • Geeignet

    Nex-N2.5 Pro

    Nex-AGI

    The models can operate computers and browsers, as well as autonomously execute and test programs.

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft flüssig auf 2 von 527 Geräten · ab 512 GB Speicher

  • Geeignet

    Inkling Small

    Thinking Machines

    The model is designed to be used by developers building AI-powered applications, including agentic and tool-use systems, coding assistants, chatbots, and retrieval-augmented generation systems, and is suitable for general-purpose conversational use, instruction-following, and other natural language and multimodal tasks.

    Quelle: huggingface.co, gelesen am 21. September 2026

    Läuft auf keinem geführten Gerät flüssig

  • Geeignet

    GLM-5.3

    Z.ai

    GLM-5.3 is the most capable open-weights model for coding, with a 50% improvement over GLM-5.2 on our in-house Z.ai Code Bench.

    Quelle: huggingface.co, gelesen am 23. September 2026

    Läuft auf keinem geführten Gerät flüssig

  • Geeignet

    Inkling

    Thinking Machines

    The model is designed to be used by developers building AI-powered applications, including agentic and tool-use systems, coding assistants, chatbots, and retrieval-augmented generation systems, and is suitable for general-purpose conversational use, instruction-following, and other natural language and multimodal tasks.

    Quelle: huggingface.co, gelesen am 21. September 2026

    Läuft auf keinem geführten Gerät flüssig

Alle Modelle für diesen Einsatzzweck

Zuerst die vom Anbieter für den Zweck genannten Modelle, dann alle anderen nach Speicherbedarf. „Ab Speicher“ ist der kleinste Arbeits- bzw. Grafikspeicher, auf dem das Modell flüssig läuft.

Geräte nach Preis

Geräte mit aktuellem Angebot aus den Händler-Feeds, günstigstes zuerst, mit dem Modell, das darauf für diesen Zweck flüssig läuft. Die Angebote selbst stehen als Partnerlinks auf der Geräteseite.