Hank Green destapa el vacío en la política de IA de YouTube

Hank Green ha señalado una grieta significativa en la política de etiquetado de IA de YouTube: la plataforma solo exige a los creadores revelar el uso de inteligencia artificial cuando el contenido alterado o generado es fotorrealista o se trata de música sintética. Quedan fuera de esa obligación us

Fish Audio cierra una ronda semilla de 50 millones para modelos de voz con IA

La startup Fish Audio, con sede en Palo Alto, anunció este martes una ronda semilla de 50 millones de dólares liderada por Coreline Ventures y Capital Today, con participación de 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners y HF0. La compañía desarro

xAI lanza 21 voces nuevas multilingües para Grok Voice

xAI ha presentado 21 voces nuevas para Grok Voice, que se suman a las cinco originales y están disponibles desde ahora en las API de Voice Agent y de Texto a Voz, así como en el nuevo Grok Voice Agent Builder, la consola de xAI para crear agentes de voz a medida. Cada voz se diseñó para un uso espec

Savi Security lanza una app que detecta estafas con IA en tiempo real

Patrick y Ryan Coughlin, veteranos de Cisco y Apple respectivamente, han lanzado Savi Security, una startup que protege a los consumidores de estafas generadas por inteligencia artificial. La compañía anunció una ronda semilla de 7 millones de dólares y el lanzamiento de su aplicación para iPhone y

VoxCPM2: sistema TTS multilingüe de código abierto con clonación de voz

OpenBMB ha lanzado VoxCPM2, la nueva versión de su sistema de síntesis de voz (TTS) que prescinde de tokenización. Se trata de un modelo de 2 000 millones de parámetros entrenado con más de dos millones de horas de datos en 30 idiomas. La herramienta permite generar voz directamente a partir de text

PersonaPlex: Voz y Roles Dinámicos en Conversaciones

PersonaPlex es un avance significativo en el campo de los modelos de habla conversacional de dobleplex, que permite interacciones de voz a voz en tiempo real con una latencia muy baja, imitando la conversación humana natural. Los sistemas de dobleplex existentes, aunque prometedores, están limitados