Skip to content

Faster-Whisper Engine ​

Faster-Whisper ist eine Neuimplementierung von OpenAI Whisper auf Basis von CTranslate2 (einer spezialisierten schnellen Inferenz-Engine für Transformer-Modelle). Im Vergleich zum originalen openai/whisper bietet es eine bis zu 4-fache Geschwindigkeit bei halbiertem Grafikspeicherbedarf.


Kernvorteile ​

  • Universelle Mehrsprachigkeit: Unterstützt über 99 Sprachen mit automatischer Spracherkennung.
  • Millisekunden-Zeitstempel auf Wortebene: Präzise Zeitachsen für den Videoschnitt und Untertiteldateien (SRT/VTT).
  • Flexible Quantisierung: Native Unterstützung für int8, int8_float16 und float16.

Konfigurationsbeispiel ​

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    engine: faster-whisper
    load:
      model_name: medium
      model_path: models/faster-whisper-medium
      device: cuda # oder cpu
      compute_type: float16 # oder int8