Skip to content

Aperçu des Moteurs ASR Supportés ​

OneASR fournit une architecture de moteur abstraite (BaseEngine) qui standardise l’initialisation des modèles, l’inférence audio et le formatage des résultats.


Guide de Choix du Moteur ​

mermaid
flowchart TD
    Start[Choisir un Moteur ASR] --> Q1{Besoin de Streaming Temps Réel ?}
    Q1 -- Oui (< 200ms) --> XASR[X-ASR / Zipformer2<br/>Streaming latence ultra-faible]
    Q1 -- Non (Fichiers Audio par Lots) --> Q2{Langue / Domaine ?}
    
    Q2 -- 99+ Langues Mondiales --> FW[Faster-Whisper<br/>Meilleur multilingue généraliste]
    Q2 -- Chinois Complexe / Dialectes --> Qwen[Qwen3-ASR<br/>Grand modèle vocal]
    Q2 -- Réunions Chinois / Entreprise --> FR[FireRedASR<br/>Mandarin haute précision]

Spécifications Détaillées ​

  • Moteur Faster-Whisper — Implémentation Whisper optimisée avec CTranslate2.
  • X-ASR (Zipformer) — Transducteur de streaming Sherpa-ONNX avec détection des silences.
  • Qwen3-ASR — Modèle vocal de pointe à 1.7B de paramètres avec support ForcedAligner.
  • FireRedASR — Moteur de reconnaissance vocale industriel pour le mandarin et l’anglais.