Google lanza Gemini 3.8 Live y su versión de razonamiento extendido

Fuentes: Google launches Gemini 3.8 Live and Extended Thinking models

Google ha presentado Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos nuevos modelos de inteligencia artificial diseñados para mejorar la interacción en tiempo casi real mediante agentes de voz y conversaciones más fluidas. El modelo 3.8 Live se centra en la eficiencia de costes y la escalabilidad, mientras que la variante Extended Thinking está optimizada para tareas de alta complejidad que requieren razonamiento multi-paso. Según los datos proporcionados, el modelo Extended Thinking lidera el índice de calidad de voz a voz de Artificial Analysis con un 82,6% y alcanza un 68,6% en la tarea de completitud agéntica en τ-Voice. Además, mantiene una puntuación del 97,7% en Big Bench Audio, demostrando su capacidad de razonamiento. El modelo Live procesa entradas visuales en tiempo casi real y detecta automáticamente 97 idiomas durante la conversación, ejecutando herramientas y llamadas a API en el fondo sin interrumpir el flujo de chat. Estas capacidades permiten a los desarrolladores integrar interfaces de voz de alto rendimiento en plataformas como Agora, LangChain y Vercel, mientras que empresas como Salesforce y Genspark han anunciado su colaboración. Los modelos incluyen marcas de agua SynthID para garantizar la transparencia y prevenir la desinformación. El lanzamiento está disponible hoy para desarrolladores a través de la API de Gemini y Google AI Studio, en vista previa privada para empresas en Gemini Enterprise, y para el público general en Search Live y aplicaciones como Gmail y Keep.