Google ha presentado Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, dos modelos para interactuar por voz y realizar tareas mediante herramientas. El anuncio de Google se publicó el 15 de septiembre y se actualizó el 17.
Para PLANA, la cuestión práctica es qué ocurre entre la petición hablada y el resultado: qué información consulta el asistente, qué acciones ejecuta y cómo podemos comprobarlas. Esa distinción ayuda a valorar el anuncio más allá de la naturalidad de la voz.
Gemini 3.8 Live y Extended Thinking: qué cambia
La documentación sobre razonamiento de Live API sitúa la diferencia en la complejidad del trabajo y el tiempo de respuesta. Extended Thinking puede razonar y usar herramientas en segundo plano mientras ofrece mensajes de progreso durante la conversación.
| Modelo | Enfoque descrito por Google |
|---|---|
| Gemini 3.8 Live | Intercambios rápidos, peticiones directas y herramientas que responden con rapidez. |
| Live Extended Thinking | Análisis de varios pasos, coordinación de herramientas y tareas que tardan más en completarse. |
Ambos admiten herramientas. En Extended Thinking, Google distingue entre terminar una intervención hablada y terminar el trabajo completo: la aplicación debe seguir el estado de la tarea. Escuchar un mensaje de progreso, por tanto, no equivale a tener el resultado.
La ficha de los modelos de Google DeepMind también recoge entradas de audio, imágenes, vídeo y texto, con respuestas de audio y texto. Son capacidades del modelo; su presencia en una aplicación concreta depende de cómo esta las incorpore.
Ver la demostración de Gemini 3.8 Live Extended Thinking en YouTube ↗. Vídeo de Google Cloud; se abre en YouTube.
Qué significa que la IA utilice herramientas
La guía de herramientas de Live API describe cómo conectar el modelo con datos y programas externos. En esa integración, la aplicación declara las funciones disponibles y gestiona sus respuestas. El desarrollador tiene que implementar ese intercambio: elegir el modelo no crea por sí solo una conexión con cualquier servicio.
Esta separación importa al leer una demostración. Una aplicación construida con la API puede disponer de conexiones distintas a las de Gemini Live. Para saber qué se puede hacer en nuestra cuenta, hay que comprobar el producto, sus funciones activas y los permisos concedidos.
Disponibilidad de Gemini 3.8 Live: productos y suscripciones
El despliegue anunciado por Google diferencia los canales:
- Desarrolladores: ambos modelos mediante Gemini API y AI Studio.
- Search Live: la versión base.
- Gemini Live y Workspace: Extended Thinking; en Docs, para Google AI Pro y Ultra, y en Gmail y Keep, para suscriptores de Google AI.
- Empresas: ambos en vista previa privada en Gemini Enterprise; otras integraciones, incluido Extended Thinking para clientes empresariales de Workspace, se anuncian para más adelante.
El anuncio no acredita disponibilidad universal en España ni en todas las cuentas. Conviene verificar la función concreta antes de contratar una suscripción por ella.
Los límites que reconoce Google
La ficha de DeepMind advierte de posibles alucinaciones —respuestas con información inventada o incorrecta—, lentitud ocasional y fallos por agotarse el tiempo de espera.
Lectura de PLANA: una conversación que avanza con fluidez puede seguir conteniendo un error. Al evaluar una tarea, interesa comprobar tanto la respuesta como los datos utilizados y cualquier cambio efectuado. Si una operación se interrumpe, también conviene revisar su estado antes de repetirla: el usuario necesita saber qué quedó hecho y qué sigue pendiente.
Un ejemplo hipotético: preparar una reunión
Imaginemos una aplicación conectada, con permiso, a unas notas de proyecto y a una lista de tareas. Le pedimos por voz que prepare los asuntos pendientes para una reunión. Es un ejemplo explicativo de PLANA, no una prueba de Gemini ni una función confirmada para todas las cuentas.
Un proceso útil empezaría por aclarar de qué proyecto hablamos. Después consultaría ambos documentos y prepararía una propuesta, señalando discrepancias: por ejemplo, una tarea que figura como terminada en las notas pero sigue abierta en la lista.
La revisión humana consistiría en comprobar los documentos citados, corregir responsables o fechas y decidir qué puntos llegan a la reunión. Actualizar la lista sería una acción aparte, que debería quedar explícitamente autorizada. La diferencia práctica está en poder seguir el trabajo y revisar sus consecuencias.
Qué evaluar cuando podamos probarlo
PLANA empezaría por una tarea pequeña cuyo resultado conozcamos. Evaluaríamos si entiende la petición, pide aclaraciones cuando falta información, respeta el alcance acordado y permite comprobar el resultado. También separaríamos el tiempo que tarda en empezar a hablar del tiempo que tarda en completar el trabajo.
La prueba debería incluir una corrección a mitad del proceso y una petición que no pueda resolver. Ver cómo reconoce un límite aporta información que una demostración sin contratiempos deja fuera. El criterio sería cuánto trabajo útil entrega y cuánto esfuerzo exige revisarlo.
PLANA todavía no ha probado estos modelos. Esta noticia explica el anuncio y su documentación; las propuestas de evaluación y el ejemplo hipotético son análisis editorial propio.
