Suno, la plataforma de generación musical por inteligencia artificial, ha introducido una nueva función en beta pública que permite crear voces habladas a partir de guiones o descripciones, acompañadas de música de fondo. Esta herramienta, disponible en las versiones web y móvil, busca diversificar la oferta de la compañía más allá de la música, ofreciendo un modelo de audio que genera voz y música de forma cohesiva. Jack Brody, director de producto de Suno, destacó que esta es la primera solución que combina ambos elementos en una sola pista, aunque la empresa reconoce que la tecnología aún está en fase de mejora y admite errores menores, como variaciones en acentos británicos.
El uso de la función es opcional y se activa mediante un interruptor para permitir o desactivar la música, lo que permite a los usuarios elegir entre un discurso limpio o una experiencia inmersiva con banda sonora. La herramienta ofrece dos modos: uno simple para descripciones básicas y otro avanzado para guiones personalizados, donde se pueden ajustar el género de la voz, el estilo y la variedad. La duración máxima de la generación es de aproximadamente ocho minutos. Esta expansión llega en un contexto de creciente competencia en el sector de la síntesis de voz, con actores como DeepMind, Adobe y ElevenLabs, y se suma a las recientes disputas legales que Suno enfrenta por derechos de autor en la industria musical.
