Skip to content

Faster-Whisper エンジン ​

Faster-Whisper は、CTranslate2(Transformer モデルに特化した高速推論エンジン)を用いて再実装された OpenAI Whisper です。オリジナルの openai/whisper と比較して、推論速度は最大 4 倍高速化され、VRAM 使用量は約半分に削減されます。


主な利点 ​

  • 汎用的な多言語サポート:自動言語検出に対応し、99 以上の世界中の言語をカバー。
  • 単語レベルのミリ秒タイムスタンプ:動画の字幕配置用として、高精度な SRT/VTT タイムラインを生成。
  • 充実した量子化サポート:int8、int8_float16、および float16 推論をネイティブサポート。

設定例 ​

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    engine: faster-whisper
    load:
      model_name: medium
      model_path: models/faster-whisper-medium
      device: cuda # または cpu
      compute_type: float16 # または int8