Motor Faster-Whisper
Faster-Whisper es una reimplementación del modelo Whisper de OpenAI utilizando CTranslate2, un motor de inferencia rápido para modelos Transformer. Es hasta 4 veces más rápido que openai/whisper con un consumo de memoria significativamente reducido.
Ventajas Principales
- Soporte Multilingüe Universal: Más de 99 idiomas con detección automática del idioma.
- Marcas de Tiempo a Nivel de Palabra: Alineación precisa para subtítulos (SRT/VTT).
- Soporte de Cuantización: Ejecución nativa en
int8,int8_float16yfloat16.
Ejemplo de Configuración
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium # tiny, base, small, medium, large-v3
model_path: models/faster-whisper-medium
device: cuda # o cpu
compute_type: float16 # o int8Pruebas de Rendimiento (Benchmark)
| Tamaño del Modelo | Parámetros | VRAM (fp16) | RTF (NVIDIA RTX 4090) |
|---|---|---|---|
| base | 74M | 1.0 GB | 0.03x |
| small | 244M | 2.0 GB | 0.06x |
| medium | 769M | 4.5 GB | 0.12x |
| large-v3 | 1550M | 8.0 GB | 0.22x |
