Aperçu des Moteurs ASR Supportés
OneASR fournit une architecture de moteur abstraite (BaseEngine) qui standardise l’initialisation des modèles, l’inférence audio et le formatage des résultats.
Guide de Choix du Moteur
mermaid
flowchart TD
Start[Choisir un Moteur ASR] --> Q1{Besoin de Streaming Temps Réel ?}
Q1 -- Oui (< 200ms) --> XASR[X-ASR / Zipformer2<br/>Streaming latence ultra-faible]
Q1 -- Non (Fichiers Audio par Lots) --> Q2{Langue / Domaine ?}
Q2 -- 99+ Langues Mondiales --> FW[Faster-Whisper<br/>Meilleur multilingue généraliste]
Q2 -- Chinois Complexe / Dialectes --> Qwen[Qwen3-ASR<br/>Grand modèle vocal]
Q2 -- Réunions Chinois / Entreprise --> FR[FireRedASR<br/>Mandarin haute précision]Spécifications Détaillées
- Moteur Faster-Whisper — Implémentation Whisper optimisée avec CTranslate2.
- X-ASR (Zipformer) — Transducteur de streaming Sherpa-ONNX avec détection des silences.
- Qwen3-ASR — Modèle vocal de pointe à 1.7B de paramètres avec support ForcedAligner.
- FireRedASR — Moteur de reconnaissance vocale industriel pour le mandarin et l’anglais.
