Skip to content

硬件算力与 GPU 加速 ​

OneASR 针对多类计算硬件深度优化,能够在多卡 GPU 服务器至轻薄笔记本上发挥出色的算力能效。


1. NVIDIA CUDA & TensorRT ​

针对高并发、高吞吐的服务器生产环境,推荐使用 NVIDIA 显卡:

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    load:
      device: "cuda"
      compute_type: "float16" # 显存受限时可设为 int8_float16

显存需求与并发对照表 ​

引擎 / 模型规格最小显存 (int8)推荐显存 (fp16)并发处理能力
Faster-Whisper Tiny/Base1.0 GB2.0 GB20+ 路并发
Faster-Whisper Small/Medium2.5 GB5.0 GB8 - 12 路并发
Faster-Whisper Large-v34.5 GB8.0 GB4 - 6 路并发
X-ASR (Zipformer ONNX)< 500 MB< 1.0 GB50+ 路并发
Qwen3-ASR (1.7B)3.5 GB6.0 GB4 - 8 路并发

2. Apple Silicon (M1 / M2 / M3 / M4) ​

在 macOS 设备上,OneASR 借助统一内存与 Apple Silicon 高性能 CPU 核心:

yaml
ASR-Providers:
  faster-whisper:
    enable: true
    load:
      device: "cpu"
      compute_type: "int8"

TIP

在搭载 Apple Silicon 芯片的 Mac 上,使用 int8 量化与 4 个 CPU 线程可达到 4 倍以上实时转录速率 (RTF < 0.25),且功耗与发热极低。