Faster-Whisper 引擎
Faster-Whisper 是基于 CTranslate2(针对 Transformer 模型的定制化快速推理引擎)重新实现的 OpenAI Whisper。相比原版 openai/whisper,速度提升高达 4 倍,显存占用减半。
核心优势
- 通用多语言支持:涵盖 99+ 种全球语言,支持自动语种检测。
- 词级毫秒时间戳:精准生成用于视频字幕对齐的 SRT/VTT 时间轴。
- 丰富的量化支持:原生支持
int8、int8_float16与float16推理。
配置示例
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium
model_path: models/faster-whisper-medium
device: cuda # 或 cpu
compute_type: float16 # 或 int8