Deutsche und europäische KI-Modelle: Welche es gibt und was davon lokal läuft

Teuken aus Deutschland, EuroLLM aus einem EU-finanzierten Verbund, Mistral aus Paris. Lizenz, Größe und auf wie vielen von 527 Geräten die Modelle flüssig laufen.

Stand: 2026-09-21

Wer nach deutschen KI-Modellen sucht, bekommt eine kurze Antwort. Wir haben ein Sprachmodell gefunden, das ein deutsches Forschungsprojekt von Grund auf trainiert hat und das Unternehmen frei nutzen und auf dem eigenen Rechner betreiben dürfen: Teuken 7B. Deutsche Weiterentwicklungen fremder Modelle gibt es mehrere; sie behandelt dieser Text nicht. Aus Europa führt unser Katalog zwei Familien dazu: EuroLLM von einem Verbund europäischer Hochschulen und Firmen und die offenen Modelle von Mistral AI aus Paris.

Dieser Text ordnet fünf dieser Modelle aus unserem Katalog ein: woher sie kommen, was ihre Lizenz erlaubt, wie groß sie sind und auf wie vielen der 527 geführten Geräte sie flüssig laufen. Er sagt auch, was wir nicht gefunden haben, denn die Lücke gehört zur Antwort.

Warum die Herkunft zählt, und wofür sie nicht reicht

Für ein Unternehmen ist die Herkunft eines Modells aus drei Gründen interessant. Die Lizenz legt fest, ob Sie es geschäftlich einsetzen dürfen. Die Dokumentation zeigt im besten Fall, wer es gebaut und bezahlt hat und womit es trainiert wurde; in den Modellkarten der Mistral-Modelle fehlen Angaben zu Geldgebern und Trainingsdaten. Und die Sprachen, mit denen ein Modell trainiert wurde, bestimmen mit, wie es mit deutschen Texten umgeht.

Für den Datenschutz zählt weniger die Herkunft als die Frage, wie und wo Sie das Modell betreiben. Das Modell selbst schickt keine Daten an seinen Hersteller, gleich ob es aus Heidelberg, Paris oder Kalifornien stammt; das Programm, das es startet, kann das sehr wohl. Was lokal betrieben wirklich im Haus bleibt und was nicht, erklärt der Ratgeber DSGVO-konforme KI. Herkunft ist ein Merkmal, kein Siegel.

Die fünf Modelle im Überblick

ModellHerkunftLizenzParameterKontextSpeicher (Q4_K_M)läuft flüssig auf
Teuken 7BOpenGPT-X, DeutschlandApache 2.07,5 Mrd.4.096 Token6,1 GB509 von 527 Geräten
EuroLLM 9BEU-finanzierter VerbundApache 2.09,2 Mrd.32.768 Token7,2 GB503 von 527 Geräten
Ministral 3 14BMistral AI, FrankreichApache 2.013,5 Mrd.262.144 Token9,9 GB378 von 527 Geräten
EuroLLM 22BEU-finanzierter VerbundApache 2.022,6 Mrd.32.768 Token15,6 GB229 von 527 Geräten
Mistral Small 3.2 24BMistral AI, FrankreichApache 2.023,6 Mrd.131.072 Token16,1 GB219 von 527 Geräten

Q4_K_M ist die verbreitete Quantisierungsstufe, also eine verkleinerte Fassung der Modelldatei. Speicherbedarf und Gerätezahl sind für 4.096 Token Kontext berechnet. Wer den längeren Kontext eines Modells ausschöpft, braucht mehr Speicher, und das Modell läuft dann auf weniger Geräten.

Alle fünf stehen unter der Apache-2.0-Lizenz und dürfen damit auch geschäftlich eingesetzt, verändert und weitergegeben werden. Wer sie weitergibt, muss unter anderem den Lizenztext beilegen und eigene Änderungen kennzeichnen. Was eine solche Lizenz im Einzelnen erlaubt, erklärt der Ratgeber Open Source KI. Der Kontext gibt an, wie viel Text ein Modell auf einmal verarbeiten kann; ein Token ist ungefähr ein Wortteil.

Teuken 7B: das Modell aus Deutschland, in der richtigen Fassung

Teuken stammt aus dem Forschungsprojekt OpenGPT-X. Entwickelt haben es laut Modellkarte Fraunhofer, das Forschungszentrum Jülich, die TU Dresden und das DFKI, gefördert vom Bundesministerium für Wirtschaft und Klimaschutz (BMWK). Die Karte beschreibt das Modell so:

„Teuken-7B-instruct-commercial-v0.4 is an instruction-tuned 7B parameter multilingual large language model (LLM) pre-trained with 4T tokens in all official 24 European languages and released under Apache 2.0 in the research project OpenGPT-X.“

Quelle: OpenGPT-X, Teuken-7B-instruct-commercial-v0.4 auf Hugging Face, gelesen am

Wichtig ist der Zusatz im Namen. Von Teuken gibt es drei Fassungen, die auf Anweisungen trainiert sind, und nur eine davon dürfen Sie im Unternehmen einsetzen:

FassungLizenzgeschäftlich nutzbar
instruct-commercial-v0.4Apache 2.0ja
instruct-research-v0.4eigene Lizenz von Fraunhofernein
instruct-v0.6CC BY-NC 4.0nein

Die Forschungsfassung erlaubt laut ihrem Lizenztext nur nicht-kommerzielle wissenschaftliche Forschung und schließt das Verändern und Weitergeben aus. Die neuere Fassung v0.6 wurde mit mehr Daten trainiert, ist aber ebenfalls nicht für den geschäftlichen Einsatz freigegeben:

„Teuken 7B-instruct-v0.6 is designed for private, non-commercial, research, and educational use in all 24 official European Union languages.“

Quelle: OpenGPT-X, Teuken-7B-instruct-v0.6 auf Hugging Face, gelesen am

Unser Katalog führt deshalb die kommerzielle Fassung. Mit der Variante Q4_K_M braucht sie rund 6,1 GB Speicher und läuft auf 509 von 527 geführten Geräten flüssig.

Die Grenze liegt beim Kontext: 4.096 Token sind für längere Dokumente eng. EuroLLM verarbeitet das Achtfache.

EuroLLM: ein Verbund statt eines Labors

EuroLLM kommt nicht von einer einzelnen Firma, sondern von einem Verbund aus Hochschulen und Unternehmen, darunter die Universitäten von Lissabon, Edinburgh und Amsterdam, Unbabel und die Sorbonne. Finanziert hat es laut Modellkarte die Europäische Union. Das Ziel beschreibt die Karte so:

„The EuroLLM project has the goal of creating a suite of LLMs capable of understanding and generating text in all European Union languages as well as some additional relevant languages.“

Quelle: utter-project, EuroLLM-22B-Instruct-2512 auf Hugging Face, gelesen am

Deutsch steht in der Sprachliste beider Größen. Die Karte des 22B-Modells hebt außerdem Übersetzungen zwischen den EU-Amtssprachen hervor.

Die kleine Größe, EuroLLM 9B, braucht mit Q4_K_M rund 7,2 GB und läuft auf 503 von 527 Geräten. Die große, EuroLLM 22B, braucht rund 15,6 GB und läuft auf 229 Geräten. Beide verarbeiten 32.768 Token Kontext. Auch EuroLLM steht nicht in der offiziellen Bibliothek von Ollama; die Startbefehle auf unseren Modellseiten laden die Dateien von Hugging Face, auch hier in Umwandlungen Dritter.

Mistral: das Unternehmen aus Paris

Mistral AI sitzt in Paris, so steht es im Impressum des Unternehmens. Zwei seiner offenen Modelle führen wir. Ministral 3 14B braucht mit Q4_K_M rund 9,9 GB und läuft auf 378 Geräten; sein Kontext von 262.144 Token ist der größte der fünf. Mistral Small 3.2 24B braucht rund 16,1 GB und läuft auf 219 Geräten.

Deutsch steht bei beiden in der Sprachliste, und beide werten laut ihren Modellkarten neben Text auch Bilder aus. Anders als Teuken und EuroLLM stehen sie in der offiziellen Bibliothek von Ollama. Die Startbefehle auf unseren Modellseiten laden beide trotzdem von Hugging Face, Ministral in der Fassung von Mistral selbst, Mistral Small 3.2 in der Umwandlung eines Dritten.

Was wir nicht gefunden haben

Ein weiteres Sprachmodell, das in Deutschland von Grund auf trainiert wurde und das Unternehmen frei nutzen dürfen, haben wir nicht gefunden. Zwei Kandidaten, auf die man dabei stößt, scheitern an der Lizenz oder am Zugang.

Aleph Alpha aus Heidelberg veröffentlicht die Gewichte seiner Pharia-Modelle, aber nicht für den geschäftlichen Einsatz:

„They are publicly available under the Open Aleph License, a license explicitly allowing for non-commercial research and educational use.“

Quelle: Aleph Alpha, Pharia-1-LLM-7B-control auf Hugging Face, gelesen am

SOOFI begegnet Ihnen, wenn Sie nach einem neuen deutschen Modell suchen. Die Modelle liegen seit Juni 2026 bei Hugging Face, tragen dort aber die Lizenzangabe closed-beta. Die Dateien erhalten Sie erst, wenn Sie Ihre Kontaktdaten angeben und der Anbieter Ihre Anfrage freigibt. Eine spätere offene Fassung kündigt die Seite an, ohne Termin:

„The final model will be released openly under a permissive license, without gated access.“

Quelle: Soofi-Project, Soofi-S-Instruct-Preview auf Hugging Face, gelesen am

Außerhalb Deutschlands stößt man zudem auf Salamandra aus Barcelona. Das Modell steht unter Apache 2.0, wurde beim Nachtraining auf Anweisungen aber vor allem auf drei andere Sprachen ausgerichtet:

„This instructed-tuned variant has been fine-tuned with a collection of 273k instructions, focusing on the performance of Catalan, English and Spanish.“

Quelle: Barcelona Supercomputing Center, salamandra-7b-instruct auf Hugging Face, gelesen am

Was ebenfalls fehlt: ein Urteil über die Qualität. Wenn die Sprachliste einer Modellkarte Deutsch nennt, heißt das nicht, dass das Modell auf Deutsch gut schreibt. Gemessen haben wir das bei keinem der fünf. Bevor Sie sich festlegen, probieren Sie das Modell mit Ihren eigenen Texten aus.

Welches für Sie passt

Wenn die Herkunft aus Deutschland zählt: Teuken 7B, und zwar in der kommerziellen Fassung. Es läuft auf fast jedem der 527 Geräte in unserem Katalog, ist aber für lange Texte knapp bemessen.

Wenn Sie längere Dokumente verarbeiten: EuroLLM mit 32.768 Token, Mistral Small 3.2 24B mit 131.072 oder Ministral 3 14B mit 262.144. Rechnen Sie dabei mit mehr Speicher als in der Tabelle oben, denn sie gilt für kurze Eingaben. Welches Modell auf Ihr Gerät passt, zeigt die Seite Ihres Geräts in unserem Katalog; wie Sie Ihr Gerät finden, beschreibt die Anleitung Welches Gerät habe ich?

Wenn auch Bilder dazugehören: Mistral Small 3.2 24B, bei dem unsere Modellseite die Bildeingabe ausweist; es braucht rund 16,1 GB. Ministral 3 14B wertet laut Modellkarte ebenfalls Bilder aus; auf unserer Modellseite ist das nicht vermerkt.

Welches Modell im Unternehmen eingesetzt wird, ist selten allein eine Technikfrage. Zur selben Auswahl gehören drei Fragen: wer entscheidet, wer zugreifen darf und wie der Einsatz dokumentiert wird.

Weitere Ratgeber