Modelo de Voz a Gran Escala Qwen3-ASR
Qwen3-ASR aporta la capacidad de comprensión a escala de LLM al reconocimiento de voz. Destaca en entornos de audio con ruido, vocabulario complejo y terminología específica de dominio.
Ejemplo de Configuración
yaml
ASR-Providers:
qwen:
enable: true
engine: qwen
load:
model_name: Qwen/Qwen3-ASR-1.7B
model_path: models/Qwen3-ASR-1.7B
device: cuda
dtype: float16
max_new_tokens: 256
max_inference_batch_size: 32