Moteur Faster-Whisper
Faster-Whisper est une réimplémentation du modèle Whisper d’OpenAI utilisant CTranslate2, un moteur d’inférence ultra-rapide pour modèles Transformer. Il est jusqu’à 4x plus rapide que openai/whisper tout en réduisant considérablement l’empreinte mémoire.
Principaux Avantages
- Support Multilingue Universel : Plus de 99 langues avec détection automatique de la langue.
- Horodatage au Niveau du Mot : Alignement précis pour la génération de sous-titres (SRT/VTT).
- Support de la Quantification : Exécution native en
int8,int8_float16etfloat16.
Exemple de Configuration
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium # tiny, base, small, medium, large-v3
model_path: models/faster-whisper-medium
device: cuda # ou cpu
compute_type: float16 # ou int8Mesures de Performance (Benchmark)
| Taille du Modèle | Paramètres | VRAM (fp16) | RTF (NVIDIA RTX 4090) |
|---|---|---|---|
| base | 74M | 1.0 Go | 0.03x |
| small | 244M | 2.0 Go | 0.06x |
| medium | 769M | 4.5 Go | 0.12x |
| large-v3 | 1550M | 8.0 Go | 0.22x |
