Faster-Whisper Engine
Faster-Whisper ist eine Neuimplementierung von OpenAI Whisper auf Basis von CTranslate2 (einer spezialisierten schnellen Inferenz-Engine für Transformer-Modelle). Im Vergleich zum originalen openai/whisper bietet es eine bis zu 4-fache Geschwindigkeit bei halbiertem Grafikspeicherbedarf.
Kernvorteile
- Universelle Mehrsprachigkeit: Unterstützt über 99 Sprachen mit automatischer Spracherkennung.
- Millisekunden-Zeitstempel auf Wortebene: Präzise Zeitachsen für den Videoschnitt und Untertiteldateien (SRT/VTT).
- Flexible Quantisierung: Native Unterstützung für
int8,int8_float16undfloat16.
Konfigurationsbeispiel
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium
model_path: models/faster-whisper-medium
device: cuda # oder cpu
compute_type: float16 # oder int8