
El anuncio original se publicó el 15 de septiembre de 2026 y Google lo actualizó el día 17 con nuevos detalles sobre disponibilidad y despliegue. La compañía diferencia claramente ambos modelos: Gemini 3.8 Live está optimizado para conversaciones fluidas, eficiencia y contexto visual, mientras que Gemini 3.8 Live Extended Thinking añade más razonamiento para tareas complejas y procesos de varios pasos.
La novedad no se limita a desarrolladores. Google está desplegando estas capacidades en productos como Gemini Live, Google Search y Google Workspace, aunque la disponibilidad concreta depende del servicio, el plan y la región.
Gemini 3.8 Live puede seguir hablando mientras ejecuta herramientas
La principal mejora de Gemini 3.8 Live está en la capacidad de mantener una conversación mientras ejecuta llamadas a herramientas y APIs en segundo plano.
Hasta ahora, uno de los problemas habituales de los asistentes de voz era que, cuando una tarea requería consultar una herramienta externa, realizar una búsqueda o completar varios pasos, la conversación podía quedarse en silencio hasta que terminase el proceso.
Con Gemini 3.8 Live, Google introduce llamadas asíncronas. El modelo puede reconocer la petición, seguir conversando y completar la tarea en segundo plano sin romper el flujo de audio.

El modelo también admite contexto visual en tiempo casi real. Esto permite combinar lo que el usuario dice con aquello que el sistema está viendo a través de una cámara o una fuente visual compatible.
Google muestra ejemplos donde Gemini guía a una persona durante un proceso de incorporación laboral, analiza una posición de ajedrez o responde preguntas relacionadas con aquello que está viendo en ese momento.
Otra mejora importante está en los idiomas. Gemini 3.8 Live puede detectar y cambiar automáticamente entre 97 idiomas durante una misma conversación, según los datos publicados por Google.
Extended Thinking razona en segundo plano sin detener la conversación
Para tareas más difíciles, Google introduce Gemini 3.8 Live Extended Thinking.
La diferencia fundamental es que este modelo puede realizar razonamiento de varios pasos en segundo plano mientras continúa hablando con el usuario. En lugar de quedarse en silencio, puede ofrecer señales verbales y actualizaciones de progreso mientras sigue procesando la petición.
Por ejemplo, ante una tarea que requiera buscar diferentes opciones, comparar datos y ejecutar varias acciones, el modelo puede indicar que está revisando la información mientras continúa trabajando.

Google lo orienta especialmente a flujos donde intervienen planificación, herramientas externas y varias decisiones consecutivas.
La compañía muestra ejemplos donde Extended Thinking transforma bocetos y comentarios de voz en componentes funcionales de React, coordina reservas mediante distintas llamadas asíncronas o construye planes empresariales a partir de una conversación.
Este comportamiento está disponible también para desarrolladores mediante la Gemini Live API, donde Google permite configurar el nivel de razonamiento del modelo.
97 idiomas, contexto visual y mejor precisión con códigos y datos
Además del razonamiento en segundo plano, Google destaca varias mejoras concretas pensadas para asistentes de voz.
Los nuevos modelos ofrecen mayor precisión con códigos de confirmación, números de reclamación y otros datos alfanuméricos, un tipo de información especialmente problemática en interfaces habladas.
También pueden combinar audio en tiempo real con datos estructurados que llegan durante la conversación, de manera que las respuestas se actualicen con nueva información sin tener que reiniciar la interacción.
| Característica | Gemini 3.8 Live | Gemini 3.8 Live Extended Thinking |
|---|---|---|
| Conversación de voz en tiempo real | Sí | Sí |
| Contexto visual | Sí | Sí |
| Idiomas | 97 | 97 |
| Llamadas a herramientas en segundo plano | Sí | Sí |
| Razonamiento multietapa avanzado | Limitado frente a Extended Thinking | Sí |
| Narración del progreso mientras razona | No es su enfoque principal | Sí |
Google atribuye además a Extended Thinking resultados destacados en diferentes benchmarks de voz y agentes. Entre ellos figura una puntuación de 82,6 en Speech-to-Speech Quality Index de Artificial Analysis y un 97,7 % en Big Bench Audio.
Estas cifras proceden de evaluaciones concretas citadas por Google y no significan que el modelo vaya a mejorar en la misma proporción en cualquier tarea real.
Gemini 3.8 Live llega a Search, Gemini y Workspace
Google ha iniciado el despliegue de ambos modelos en diferentes productos.
Gemini 3.8 Live está disponible para desarrolladores a través de Gemini API y Google AI Studio. Para empresas se ofrece inicialmente en vista previa privada mediante Gemini Enterprise, mientras que para usuarios generales Google lo está incorporando en Search Live.
Gemini 3.8 Live Extended Thinking también está disponible para desarrolladores mediante la API y AI Studio. En productos para consumidores, Google confirma su despliegue en Gemini Live.
También está llegando a Google Workspace: los usuarios de Google AI Pro y Ultra pueden utilizarlo en Docs, mientras que Google indica disponibilidad en Gmail y Keep para suscriptores de Google AI compatibles.

Google no ofrece en el anuncio un calendario específico para España ni garantiza que todas estas funciones aparezcan simultáneamente en todas las cuentas. La disponibilidad puede depender del producto, la suscripción, el tipo de cuenta y la región.
Para desarrolladores, Google publica además un precio de 0,005 dólares por minuto de audio de entrada y 0,018 dólares por minuto de audio de salida a través de Gemini Live API.
Todo el audio generado por estos modelos incorpora además SynthID, la marca de agua imperceptible de Google destinada a identificar contenido generado mediante inteligencia artificial.
Gemini 3.8 sigue ampliándose con modelos especializados
El lanzamiento llega apenas unas semanas después de que Google ampliase la familia Gemini 3.8 con otras variantes.
En Hardmaniacos ya vimos Gemini 3.8 Flash y Flash Cyber, orientadas respectivamente a programación, agentes y ciberseguridad defensiva. Los nuevos Live siguen una estrategia diferente: llevar esa capacidad de razonamiento a interfaces de voz que puedan actuar sin detener la conversación.
También coincide con la llegada de la aplicación oficial de Gemini para Windows 10 y 11, que permite acceder al asistente directamente desde el escritorio mediante Alt + Espacio.
Con Gemini 3.8 Live y Extended Thinking, Google intenta reducir una de las limitaciones más evidentes de los asistentes de voz: la necesidad de elegir entre responder rápido o detenerse para razonar. El nuevo enfoque busca hacer ambas cosas al mismo tiempo, manteniendo la conversación mientras las tareas más complejas se resuelven en segundo plano.
Fuentes: Google — Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, Google — nuevos modelos Gemini Audio para desarrolladores y Google AI for Developers — Thinking in the Live API.