La variante Extended Thinking está diseñada para razonar en segundo plano y ejecutar tareas de varios pasos sin interrumpir la conversación.

Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos centrados en conversaciones de voz más naturales y en tiempo real. Y es que ahora tenemos más modelos en 3.8, que quedan más o menos así:
| Modelo | Enfoque | Uso recomendado |
|---|---|---|
| Gemini 3.8 Live | Baja latencia y respuestas directas | Asistentes de voz, diálogo rápido y tareas simples |
| Gemini 3.8 Live Extended Thinking | Razonamiento más profundo y tareas complejas | Investigación, resolución de problemas, planificación y flujos que requieren varias acciones |
El modelo estándar busca priorizar la inmediatez. El Extended Thinking puede dedicar más procesamiento a evaluar un problema, utilizar herramientas asíncronas y continuar hablando mientras completa acciones de fondo.
La principal novedad es que Gemini 3.8 Live Extended Thinking puede “pensar y hablar” simultáneamente. Por ejemplo, en vez de quedarse en silencio durante una búsqueda compleja, puede responder con frases naturales como “déjame comprobarlo” y explicar el avance mientras consulta información o realiza pasos adicionales.
Esto pretende reducir la sensación de espera que suelen generar los asistentes por voz cuando necesitan buscar información, comparar opciones o ejecutar herramientas externas. Es especialmente útil en tareas como:
Gemini 3.8 Live Extended Thinking admite texto, imágenes, audio y vídeo como entrada, y puede generar respuestas tanto en texto como en audio. Ofrece una ventana de contexto de hasta 131.072 tokens de entrada y 65.536 tokens de salida.
El modelo incorpora llamadas a funciones, pero solo de forma asíncrona. Esto significa que las herramientas externas deben poder ejecutarse sin bloquear la conversación, permitiendo que el asistente siga interactuando mientras espera el resultado.
También permite configurar distintos niveles de razonamiento —bajo, medio y alto— según el equilibrio deseado entre rapidez, coste y calidad de respuesta. El modelo Live estándar, en cambio, no admite ajustar ese nivel: está diseñado para reaccionar rápidamente.
Gemini 3.8 Live llega a Search Live, mientras que Gemini 3.8 Live Extended Thinking empieza a desplegarse en Gemini Live. Los usuarios de los planes AI Pro y AI Ultra también recibirían acceso al modelo avanzado en Gmail, Docs y Keep.
Para desarrolladores, ambos modelos están disponibles a través de Gemini API y Google AI Studio. En entornos empresariales, la disponibilidad inicial se plantea mediante un programa privado de pruebas de Gemini Enterprise.
El modelo no convierte automáticamente a Gemini en un agente autónomo capaz de hacer cualquier cosa por ti. Su valor está en mejorar el manejo de tareas largas o ambiguas en una conversación de voz: puede mantener el contexto, comunicar su progreso y dedicar más razonamiento a decisiones de varios pasos.
Un ejemplo: en lugar de limitarse a contestar una pregunta sobre un viaje, podría conversar contigo mientras compara alternativas, identifica restricciones que mencionaste y te presenta una propuesta organizada. La experiencia dependerá de las herramientas conectadas, los permisos que otorgues y la disponibilidad del despliegue en tu cuenta.