Whisper medium

Whisper medium braucht mit der Stufe q5_0 rund 1,0 GB Speicher und passt auf 643 von 643 geführten Geräten.

Wie schnell es arbeitet, rechnen wir nicht. Bei Audio zählt, wie viele Minuten Aufnahme in einer Minute fertig werden, und dafür haben wir noch keine eigene Messung.

Speicher heißt hier: die Datei plus der Zuschlag aus der Tabelle zum Speicherbedarf von whisper.cpp (Zeile „medium“). Die Tabelle gilt für die unkomprimierte Datei; für kleinere Stufen nehmen wir denselben Zuschlag an.

Art
Transkription (Sprache zu Text)
Anbieter
OpenAI
Parameter
769 Mio.
Auf Hugging Face seit
26. September 2022
Lizenz
MIT
Deutsch
laut Anbieter ja (Beleg unten)
Laufzeit
whisper.cpp
Ollama
führt dieses Modell nicht

So starten Sie es

Im Ordner von whisper.cpp, nachdem Sie es laut Anleitung gebaut haben. whisper-cli liest WAV-Dateien mit 16 Bit; der Schalter -l de legt die Sprache fest.

Modell laden

$ sh ./models/download-ggml-model.sh medium-q5_0

Aufnahme transkribieren

$ ./build/bin/whisper-cli -m models/ggml-medium-q5_0.bin -l de -f aufnahme.wav

Lizenz

Laut Anbieter steht das Modell unter MIT. Die Quelle sagt dazu wörtlich:

Whisper's code and model weights are released under the MIT License.
https://github.com/openai/whisper/blob/main/README.md, gelesen am 6. Oktober 2026

Das ist keine Rechtsberatung. Maßgeblich ist der Lizenztext selbst.

Deutsch

Der Anbieter nennt Deutsch ausdrücklich. Wie gut es Deutsch versteht oder spricht, haben wir nicht geprüft.

"de": "german",
https://github.com/openai/whisper/blob/main/whisper/tokenizer.py

Geräte und Grafikkarten

Passt auf 643 von 643 Geräten und auf 115 von 115 Grafikkarten im Katalog.

Stufen

Größe der Datei je Stufe und, wo belegt, der Speicher beim Laufen.

StufeDateiSpeicher beim Laufen
q5_00,5 GB1,0 GB
q8_00,8 GB1,3 GB
f161,5 GB2,0 GB

Quelle: https://huggingface.co/openai/whisper-medium · https://github.com/ggml-org/whisper.cpp/blob/master/README.md#memory-usage

Weitere Ratgeber