Whisper self-hosted: Transkription ohne Cloud

sgit.space
1 min read
Whisper self-hosted: Transkription ohne Cloud
```html

Whisper lokal installieren

Wir nutzen Whisper für die Transkription von Audio- und Videodateien auf unserer Self-Hosted-Plattform sgit.space. Die Installation erfolgt direkt auf einem Server mit GPU-Unterstützung, da die CPU-Transkription in der Praxis zu langsam ist. Die Modelle werden von OpenAI bereitgestellt und lassen sich über die offizielle Python-Bibliothek oder kompatible Forks wie faster-whisper nutzen.

Voraussetzungen für die lokale Nutzung

Whisper benötigt eine stabile Python-Umgebung, idealerweise ab Version 3.9. Zusätzlich sind FFmpeg und CUDA-Treiber erforderlich, falls eine GPU genutzt wird. Wir empfehlen eine isolierte Umgebung mit venv oder conda, um Abhängigkeiten sauber zu verwalten. Die Modelle werden beim ersten Aufruf heruntergeladen und benötigen mehrere Gigabyte Speicherplatz.

Transkription automatisieren

Auf sgit.space setzen wir Skripte ein, die Whisper im Batch-Modus verarbeiten. Ein einfaches Python-Skript nimmt Dateien aus einem Eingangsordner entgegen, transkribiert sie und legt die Ergebnisse als TXT oder SRT ab. Die Spracherkennung funktioniert auch ohne manuelle Angabe, aber explizite Sprachparameter erhöhen die Genauigkeit.

Performance-Optimierungen

Für den produktiven Einsatz haben wir Whisper mit faster-whisper kombiniert, das auf ctranslate2 basiert. Dadurch reduzieren sich Latenz und Speicherverbrauch deutlich. Kleine Modelle wie tiny oder base sind für Echtzeitanwendungen geeignet, während large-v3 maximale Genauigkeit bietet – allerdings mit hohen Ressourcenkosten.

Integration in bestehende Dienste

Whisper läuft bei uns als eigenständiger Dienst, der über eine REST-API angebunden wird. Eine Minimalvariante mit Flask oder FastAPI reicht aus, um Dateien entgegenzunehmen und Transkripte zurückzuliefern. Für größere Workflows kann die Ausgabe direkt in Datenbanken oder Suchindizes geschrieben werden.

Datenschutz und Offline-Betrieb

Der Hauptvorteil der lokalen Installation ist die vollständige Unabhängigkeit von Cloud-Diensten. Alle Daten bleiben innerhalb der eigenen Infrastruktur, was für vertrauliche Inhalte essenziell ist. Bei uns erfolgt keine externe Kommunikation, sobald die Modelle einmal heruntergeladen sind.

```