Faster-Whisper 引擎
Faster-Whisper 是基於 CTranslate2(針對 Transformer 模型的客製化快速推論引擎)重新實作的 OpenAI Whisper。相比原版 openai/whisper,速度提升高達 4 倍,顯示卡記憶體佔用減半。
核心優勢
- 通用多語言支援:涵蓋 99+ 種全球語言,支援自動語種檢測。
- 詞級毫秒時間戳記:精準生成用於影片字幕對齊的 SRT/VTT 時間軸。
- 豐富的量化支援:原生支援
int8、int8_float16與float16推論。
設定範例
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium
model_path: models/faster-whisper-medium
device: cuda # 或 cpu
compute_type: float16 # 或 int8