Nari Qwen3-TTS and Qwen3-ASR - High-accuracy, low-latency voice AI
Show HN: Nari Qwen3-TTS and Qwen3-ASR – High accuracy, low latency and cost

Nari Labs präsentiert Qwen3-TTS und Qwen3-ASR, zwei Modelle, die auf Covals Voice-AI-Benchmarks die Pareto-Grenze für Qualität und Latenz erreichen. Qwen3-ASR Fast liefert eine Time-to-Final-Segment von 44 ms bei 3,6 % WER, während Qwen3-TTS Fast eine Time-to-First-Audio von 63 ms bei 3,8 % WER erreicht. Beide Endpunkte sind extrem kostengünstig: $0,12 pro Stunde für STT und $10 pro 1M Zeichen für TTS. Die APIs sind jetzt in einer kostenlosen Beta verfügbar, mit $20 Guthaben für neue Nutzer.
Nari Labs führt Covals Voice-AI-Benchmark an, indem es sowohl bei Text-to-Speech als auch bei Speech-to-Text auf der Pareto-Grenze für Qualität und Latenz liegt.