Faster-Whisper エンジン
Faster-Whisper は、CTranslate2(Transformer モデルに特化した高速推論エンジン)を用いて再実装された OpenAI Whisper です。オリジナルの openai/whisper と比較して、推論速度は最大 4 倍高速化され、VRAM 使用量は約半分に削減されます。
主な利点
- 汎用的な多言語サポート:自動言語検出に対応し、99 以上の世界中の言語をカバー。
- 単語レベルのミリ秒タイムスタンプ:動画の字幕配置用として、高精度な SRT/VTT タイムラインを生成。
- 充実した量子化サポート:
int8、int8_float16、およびfloat16推論をネイティブサポート。
設定例
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium
model_path: models/faster-whisper-medium
device: cuda # または cpu
compute_type: float16 # または int8