Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos de inteligencia artificial diseñados para mantener conversaciones de voz más fluidas y ejecutar tareas mientras el usuario continúa hablando.

Ambos modelos comenzaron su distribución el 15 de septiembre de 2026. Google actualizó posteriormente su anuncio para precisar su disponibilidad en Gemini, Search, Google Workspace, la API de Gemini y Google AI Studio.
Gemini 3.8 Live se enfoca en velocidad, diálogo natural y eficiencia. Extended Thinking está destinado a solicitudes más complejas que necesitan razonamiento en varios pasos.
¿Qué es Gemini 3.8 Live?
Gemini 3.8 Live es un modelo nativo de conversación por voz. Esto significa que puede recibir audio y producir una respuesta hablada sin depender completamente de una cadena separada de transcripción, procesamiento y lectura.
El modelo también acepta texto, imágenes y video como información de entrada. De esta manera, puede responder tanto a lo que escucha como a lo que observa mediante una cámara o contenido compartido.
Google lo presenta como la opción predeterminada para experiencias que necesitan baja latencia. Su objetivo consiste en reducir las pausas poco naturales que suelen ocurrir entre una pregunta y la respuesta de un asistente.
El sistema también admite razonamiento intercalado. Sin embargo, está diseñado principalmente para conservar la rapidez de la conversación.
Extended Thinking está dirigido a tareas complejas
Gemini 3.8 Live Extended Thinking utiliza más razonamiento para resolver procesos con varios pasos.
Mientras analiza la solicitud, puede ofrecer indicaciones breves como “déjame comprobarlo” y explicar el avance de una tarea. De ese modo, el usuario no permanece en silencio sin saber si el asistente sigue trabajando.
Google mostró ejemplos relacionados con reservaciones, preparación de planes empresariales, transformación de bocetos en componentes de software y organización de tareas.
El modelo no debe confundirse con una garantía de que cualquier acción podrá completarse automáticamente. Para utilizar servicios externos, necesita herramientas, permisos e integraciones compatibles.
Puede ejecutar herramientas sin detener la conversación
Una de las novedades más importantes es la ejecución asíncrona de funciones. El modelo puede llamar a una herramienta o consultar una interfaz externa mientras mantiene activa la conversación.
Por ejemplo, una aplicación podría solicitar información sobre vuelos y, mientras recibe esos resultados, permitir que el usuario pregunte por el clima del destino.
En sistemas anteriores, la conversación podía quedar en silencio mientras la herramienta terminaba su trabajo. Gemini 3.8 Live puede reconocer la solicitud, continuar escuchando y comunicar el resultado cuando esté disponible.
Esta capacidad será especialmente útil para asistentes de atención al cliente, aplicaciones de reservaciones, servicios de soporte técnico y herramientas de productividad.
Gemini puede utilizar información visual
El modelo analiza entradas visuales casi en tiempo real. Un usuario puede mostrar un objeto, una pantalla o un documento mientras formula preguntas mediante la voz.
Google utiliza como ejemplo el proceso de incorporación de empleados. Un asistente puede observar la pantalla, escuchar la pregunta y explicar dónde se encuentra una función o qué paso debe realizarse.
La comprensión visual también podría aplicarse a soporte técnico, aprendizaje, compras y accesibilidad.
No obstante, compartir imágenes o una cámara con un asistente implica proporcionar información visual al servicio. El usuario debe revisar qué aparece en el encuadre y evitar mostrar datos privados que no sean necesarios para la consulta.
Cambio automático entre 97 idiomas
Google afirma que Gemini 3.8 Live puede detectar y cambiar automáticamente entre 97 idiomas durante una misma conversación.
Esta capacidad permite que una persona formule una pregunta en un idioma, incluya términos en otro y solicite una respuesta diferente sin configurar manualmente cada cambio.
El soporte técnico no garantiza el mismo rendimiento en todos los idiomas, acentos o regiones. La precisión deberá evaluarse en situaciones reales, especialmente cuando existan nombres propios, números o vocabulario especializado.
Para desarrolladores, Google también destaca una mayor precisión al reconocer códigos de confirmación, números de reclamaciones y datos alfanuméricos.
¿Dónde se puede utilizar Gemini 3.8 Live?
La versión estándar comenzó a distribuirse en:
- Gemini API.
- Google AI Studio.
- Search Live.
- Una vista previa privada para algunas empresas.
Gemini 3.8 Live Extended Thinking está llegando a la API y Google AI Studio. También aparece en Gemini Live y en herramientas seleccionadas de Google Workspace.
En Docs, el acceso está dirigido inicialmente a suscriptores de Google AI Pro y Ultra. En Gmail y Keep, Google menciona disponibilidad para suscriptores de sus planes de inteligencia artificial.
Por tanto, no todas las funciones serán gratuitas ni aparecerán inmediatamente en todas las cuentas.
Funciones en Gmail, Docs, Keep y Search
Dentro de Workspace, los modelos permiten conversar sobre un documento, redactar mediante instrucciones verbales o trabajar con información almacenada en el correo.
En Gmail Live, el usuario puede solicitar ayuda para revisar mensajes y organizar su bandeja. Keep Live puede ayudar a capturar y estructurar ideas mediante una conversación.
Search Live utiliza el modelo para ofrecer orientación verbal paso a paso. Un caso práctico sería mostrar un dispositivo que presenta una falla y pedir indicaciones mientras se realizan las comprobaciones.
Estas experiencias dependerán del país, la cuenta y el plan contratado.
Audio generado identificado con SynthID
Google informó que el audio producido por sus herramientas de inteligencia artificial lleva una marca imperceptible de SynthID.
La marca busca permitir que los sistemas compatibles identifiquen contenido generado por IA. No funciona necesariamente como una etiqueta audible ni evita por sí sola que alguien utilice el audio de manera engañosa.
Por ello, la compañía mantiene políticas y medidas adicionales para reducir riesgos. Aun así, la evolución de las voces sintéticas plantea desafíos para verificar grabaciones y combatir la suplantación.
Gemini 3.8 Live representa un paso hacia asistentes que no solo responden preguntas, sino que observan, conversan y utilizan herramientas simultáneamente. Su verdadera utilidad dependerá de la precisión, la privacidad y la cantidad de funciones que Google lleve a las cuentas gratuitas.