Nari Qwen3-TTS and Qwen3-ASR - High-accuracy, low-latency voice AI models
Show HN: Nari Qwen3-TTS and Qwen3-ASR – High accuracy, low latency and cost

Nari Labs presenta Qwen3-TTS y Qwen3-ASR, modelos de voz que lideran los benchmarks de Coval en precisión y latencia. Qwen3-ASR Fast logra un TTFS de 44 ms y un WER de 3.6%, mientras que Qwen3-TTS Fast alcanza un TTFA de 63 ms y un WER de 3.8%, con precios desde $0.06 por hora y $5 por millón de caracteres. Ideales para agentes de voz que requieren respuestas rápidas y naturales, estos modelos superan a alternativas como ElevenLabs y Deepgram en costo y rendimiento. Pruébalos gratis por tiempo limitado y obtén $20 en créditos al migrar a la versión de pago.
Nari Labs lidera el benchmark de voz de Coval al situarse en la frontera de Pareto calidad-latencia tanto para Text-to-Speech como para Speech-to-Text.