Skip to content

Modelo de Voz a Gran Escala Qwen3-ASR ​

Qwen3-ASR aporta la capacidad de comprensión a escala de LLM al reconocimiento de voz. Destaca en entornos de audio con ruido, vocabulario complejo y terminología específica de dominio.


Ejemplo de Configuración ​

yaml
ASR-Providers:
  qwen:
    enable: true
    engine: qwen
    load:
      model_name: Qwen/Qwen3-ASR-1.7B
      model_path: models/Qwen3-ASR-1.7B
      device: cuda
      dtype: float16
      max_new_tokens: 256
      max_inference_batch_size: 32