Skip to content

Moteur Faster-Whisper ​

Faster-Whisper est une réimplémentation du modèle Whisper d’OpenAI utilisant CTranslate2, un moteur d’inférence ultra-rapide pour modèles Transformer. Il est jusqu’à 4x plus rapide que openai/whisper tout en réduisant considérablement l’empreinte mémoire.


Principaux Avantages ​

  • Support Multilingue Universel : Plus de 99 langues avec détection automatique de la langue.
  • Horodatage au Niveau du Mot : Alignement précis pour la génération de sous-titres (SRT/VTT).
  • Support de la Quantification : Exécution native en int8, int8_float16 et float16.

Exemple de Configuration ​

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    engine: faster-whisper
    load:
      model_name: medium # tiny, base, small, medium, large-v3
      model_path: models/faster-whisper-medium
      device: cuda # ou cpu
      compute_type: float16 # ou int8

Mesures de Performance (Benchmark) ​

Taille du ModèleParamètresVRAM (fp16)RTF (NVIDIA RTX 4090)
base74M1.0 Go0.03x
small244M2.0 Go0.06x
medium769M4.5 Go0.12x
large-v31550M8.0 Go0.22x