Noticias

Google lanza Gemini 3.8 Live y Extended Thinking

La variante Extended Thinking está diseñada para razonar en segundo plano y ejecutar tareas de varios pasos sin interrumpir la conversación.

Compartir

Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos centrados en conversaciones de voz más naturales y en tiempo real. Y es que ahora tenemos más modelos en 3.8, que quedan más o menos así:

Dos modelos, objetivos distintos

ModeloEnfoqueUso recomendado
Gemini 3.8 LiveBaja latencia y respuestas directasAsistentes de voz, diálogo rápido y tareas simples
Gemini 3.8 Live Extended ThinkingRazonamiento más profundo y tareas complejasInvestigación, resolución de problemas, planificación y flujos que requieren varias acciones

El modelo estándar busca priorizar la inmediatez. El Extended Thinking puede dedicar más procesamiento a evaluar un problema, utilizar herramientas asíncronas y continuar hablando mientras completa acciones de fondo.

Qué cambia en la conversación

La principal novedad es que Gemini 3.8 Live Extended Thinking puede “pensar y hablar” simultáneamente. Por ejemplo, en vez de quedarse en silencio durante una búsqueda compleja, puede responder con frases naturales como “déjame comprobarlo” y explicar el avance mientras consulta información o realiza pasos adicionales.

Esto pretende reducir la sensación de espera que suelen generar los asistentes por voz cuando necesitan buscar información, comparar opciones o ejecutar herramientas externas. Es especialmente útil en tareas como:

  • Buscar y sintetizar correos en Gmail mediante conversación.
  • Redactar, corregir o transformar contenido en Google Docs.
  • Crear notas y organizar información con Keep.
  • Ayudar a diagnosticar un problema técnico paso a paso.
  • Resolver dudas complejas mientras mantiene un diálogo natural.

Capacidades técnicas

Gemini 3.8 Live Extended Thinking admite texto, imágenes, audio y vídeo como entrada, y puede generar respuestas tanto en texto como en audio. Ofrece una ventana de contexto de hasta 131.072 tokens de entrada y 65.536 tokens de salida.

El modelo incorpora llamadas a funciones, pero solo de forma asíncrona. Esto significa que las herramientas externas deben poder ejecutarse sin bloquear la conversación, permitiendo que el asistente siga interactuando mientras espera el resultado.

También permite configurar distintos niveles de razonamiento —bajo, medio y alto— según el equilibrio deseado entre rapidez, coste y calidad de respuesta. El modelo Live estándar, en cambio, no admite ajustar ese nivel: está diseñado para reaccionar rápidamente.

Disponibilidad

Gemini 3.8 Live llega a Search Live, mientras que Gemini 3.8 Live Extended Thinking empieza a desplegarse en Gemini Live. Los usuarios de los planes AI Pro y AI Ultra también recibirían acceso al modelo avanzado en Gmail, Docs y Keep.

Para desarrolladores, ambos modelos están disponibles a través de Gemini API y Google AI Studio. En entornos empresariales, la disponibilidad inicial se plantea mediante un programa privado de pruebas de Gemini Enterprise.

Qué significa para usuarios

El modelo no convierte automáticamente a Gemini en un agente autónomo capaz de hacer cualquier cosa por ti. Su valor está en mejorar el manejo de tareas largas o ambiguas en una conversación de voz: puede mantener el contexto, comunicar su progreso y dedicar más razonamiento a decisiones de varios pasos.

Un ejemplo: en lugar de limitarse a contestar una pregunta sobre un viaje, podría conversar contigo mientras compara alternativas, identifica restricciones que mencionaste y te presenta una propuesta organizada. La experiencia dependerá de las herramientas conectadas, los permisos que otorgues y la disponibilidad del despliegue en tu cuenta.

Julio Herrera Zúñiga

Editor y redactor. Me gustan los juegos de Nintendo, el Miami Heat, los Miami Dolphins, los celulares y los animales.

Los comentarios de Disqus están cargando....
Publicado por
Julio Herrera Zúñiga