Nari Labs lidera los benchmarks de voz de Coval en latencia y coste

Fuentes: Nari Labs Leads Coval’s Voice AI Benchmarks in Latency and Cost

Nari Labs ha consolidado su posición como líder en los benchmarks de inteligencia artificial de voz de Coval, superando a la mayoría de los modelos públicos disponibles en las métricas de latencia y coste. Según los datos de mediados de septiembre de 2026, la empresa ocupa la primera posición en la frontera de Pareto de calidad-latencia para la síntesis de voz (TTS) y la transcripción de voz (STT). En la categoría de STT, el modelo Qwen3-ASR Fast de Nari Labs se sitúa en el primer lugar en latencia (tiempo hasta el segmento final) con un 44 ms en el percentil 50, y en el segundo lugar en tasa de error de palabras (WER) con un 3,6%, por detrás del Universal 3.5 Pro de AssemblyAI. En TTS, el modelo Qwen3-TTS Fast ocupa el segundo puesto en latencia (tiempo hasta el primer audio) con 63 ms y el primer puesto en WER con un 3,8%. Además, Nari Labs lidera la frontera de latencia-coste y calidad-coste entre todos los modelos públicos evaluados. En cuanto a la economía, el endpoint Fast de STT tiene un coste de 0,12 dólares por hora, el segundo más bajo del directorio de precios de Coval, mientras que el endpoint de TTS es el más barato con 10 dólares por millón de caracteres. La compañía anuncia que sus APIs de beta pública pasarán a producción generalizada esta semana, ofreciendo 20 dólares en créditos a los usuarios que se registren antes del cambio.