Faster-Whisper 엔진
Faster-Whisper는 Transformer 모델에 특화된 고속 추론 엔진인 CTranslate2를 기반으로 OpenAI Whisper를 재구현한 엔진입니다. 오리지널 openai/whisper 대비 최대 4배의 속도 향상과 VRAM 사용량 50% 절감을 실현합니다.
핵심 장점
- 범용 다국어 지원: 99개 이상의 전 세계 언어를 지원하며 자동 언어 감지를 제공합니다.
- 단어 단위 밀리초 타임스탬프: 비디오 자막 싱크에 정밀하게 일치하는 SRT/VTT 타임라인을 생성합니다.
- 다양한 양자화 옵션:
int8,int8_float16,float16추론을 기본 지원합니다.
설정 예시
yaml
ASR-Providers:
faster-whisper:
enable: true
engine: faster-whisper
load:
model_name: medium
model_path: models/faster-whisper-medium
device: cuda # 또는 cpu
compute_type: float16 # 또는 int8