Una implementación open source de Qwen3-TTS alcanza sub-50 ms de latencia en una sola H100
Nari Labs presenta una implementación open source del modelo de síntesis de voz Qwen3-TTS CustomVoice 1.7B que alcanza 10 peticiones por segundo (RPS) con un tiempo al primer audio (TTFA) inferior a 50 milisegundos en percentil 95 sobre una única GPU NVIDIA H100 SXM. El equipo comparó su sistema con
