
Google anunció una nueva generación de sus modelos de inteligencia artificial orientados a las conversaciones por voz. Se trata de Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, tecnologías diseñadas para que las interacciones con la IA sean más rápidas, naturales y capaces de realizar tareas complejas mientras mantienen la conversación.
Una de las principales novedades es que estos sistemas pueden procesar información de audio, imágenes y texto durante una interacción en tiempo real. Gemini 3.8 Live está pensado principalmente para responder rápidamente y mantener un diálogo continuo, mientras que la versión Extended Thinking está orientada a problemas que necesitan varios pasos de razonamiento.
La versión más avanzada puede continuar hablando mientras trabaja en segundo plano. Por ejemplo, cuando una tarea requiere consultar herramientas o realizar varias operaciones, la IA puede proporcionar actualizaciones durante el proceso en lugar de permanecer en silencio hasta terminar.
Otra característica destacada es su capacidad para manejar 97 idiomas y cambiar entre ellos durante una misma conversación. Además, puede utilizar información visual para comprender mejor aquello que el usuario está mostrando y responder teniendo en cuenta ese contexto.
Google también señala que los nuevos modelos pueden utilizar herramientas y aplicaciones mientras mantienen activa la conversación. Esto abre posibilidades para asistentes capaces de realizar tareas más elaboradas mediante comandos de voz.
Los modelos comenzaron a distribuirse el 15 de septiembre de 2026. Los desarrolladores pueden acceder a ellos mediante la API de Gemini y Google AI Studio, mientras que algunas funciones también están llegando a productos como Search Live, Gemini y Google Workspace.
Además, Google indicó que el audio generado por sus productos de IA incorpora SynthID, una marca de agua digital diseñada para ayudar a identificar contenido creado artificialmente.
Con estos avances, Google busca que las conversaciones con inteligencia artificial se parezcan cada vez más a un diálogo continuo, en el que el sistema pueda escuchar, responder, analizar información y realizar tareas sin interrumpir constantemente la interacción.




















































