Skip to content

Motor Faster-Whisper ​

Faster-Whisper es una reimplementación del modelo Whisper de OpenAI utilizando CTranslate2, un motor de inferencia rápido para modelos Transformer. Es hasta 4 veces más rápido que openai/whisper con un consumo de memoria significativamente reducido.


Ventajas Principales ​

  • Soporte Multilingüe Universal: Más de 99 idiomas con detección automática del idioma.
  • Marcas de Tiempo a Nivel de Palabra: Alineación precisa para subtítulos (SRT/VTT).
  • Soporte de Cuantización: Ejecución nativa en int8, int8_float16 y float16.

Ejemplo de Configuración ​

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    engine: faster-whisper
    load:
      model_name: medium # tiny, base, small, medium, large-v3
      model_path: models/faster-whisper-medium
      device: cuda # o cpu
      compute_type: float16 # o int8

Pruebas de Rendimiento (Benchmark) ​

Tamaño del ModeloParámetrosVRAM (fp16)RTF (NVIDIA RTX 4090)
base74M1.0 GB0.03x
small244M2.0 GB0.06x
medium769M4.5 GB0.12x
large-v31550M8.0 GB0.22x