Grand Modèle Vocal Qwen3-ASR
Qwen3-ASR apporte la puissance de compréhension des LLM à la reconnaissance vocale. Il excelle dans les environnements bruyants, le vocabulaire complexe et les jargons techniques spécialisés.
Exemple de Configuration
yaml
ASR-Providers:
qwen:
enable: true
engine: qwen
load:
model_name: Qwen/Qwen3-ASR-1.7B
model_path: models/Qwen3-ASR-1.7B
device: cuda
dtype: float16
max_new_tokens: 256
max_inference_batch_size: 32