硬件算力与 GPU 加速
OneASR 针对多类计算硬件深度优化,能够在多卡 GPU 服务器至轻薄笔记本上发挥出色的算力能效。
1. NVIDIA CUDA & TensorRT
针对高并发、高吞吐的服务器生产环境,推荐使用 NVIDIA 显卡:
yaml
ASR-Providers:
faster-whisper:
enable: true
load:
device: "cuda"
compute_type: "float16" # 显存受限时可设为 int8_float16显存需求与并发对照表
| 引擎 / 模型规格 | 最小显存 (int8) | 推荐显存 (fp16) | 并发处理能力 |
|---|---|---|---|
| Faster-Whisper Tiny/Base | 1.0 GB | 2.0 GB | 20+ 路并发 |
| Faster-Whisper Small/Medium | 2.5 GB | 5.0 GB | 8 - 12 路并发 |
| Faster-Whisper Large-v3 | 4.5 GB | 8.0 GB | 4 - 6 路并发 |
| X-ASR (Zipformer ONNX) | < 500 MB | < 1.0 GB | 50+ 路并发 |
| Qwen3-ASR (1.7B) | 3.5 GB | 6.0 GB | 4 - 8 路并发 |
2. Apple Silicon (M1 / M2 / M3 / M4)
在 macOS 设备上,OneASR 借助统一内存与 Apple Silicon 高性能 CPU 核心:
yaml
ASR-Providers:
faster-whisper:
enable: true
load:
device: "cpu"
compute_type: "int8"TIP
在搭载 Apple Silicon 芯片的 Mac 上,使用 int8 量化与 4 个 CPU 线程可达到 4 倍以上实时转录速率 (RTF < 0.25),且功耗与发热极低。
