Gemini Live mejora en razonamiento, fluidez conversacional y ejecución de tareas en segundo plano. Esta es la diferencia entre los 2 modelos.[…]
La entrada El asistente de voz de Google, más inteligente y ágil gracias a los modelos Gemini 3.8 Live y 3.8 Live Extended Thinking se publicó primero en Marketing4eCommerce.
La interacción por voz en tiempo real con asistentes de IA es uno de los campos en los que Google está concentrando sus esfuerzos para ofrecer una experiencia de uso más fluida a sus usuarios y usuarias. Su último avance al respecto han sido los recién anunciados modelos Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking.
Estos asistentes de voz, al igual que sus antecesores, permiten mantener conversaciones de voz fluidas, naturales y en tiempo real, pero destacan por presentar avances significativos en sus capacidades de razonamiento y de ejecución de tareas en segundo plano, así como por ofrecer una mayor fluidez conversacional.
De este modo, entablar conversaciones a viva voz con Gemini Live a través de la app de Gemini, de Google Workspace o de la Búsqueda, se convierte en un proceso más ágil, intuitivo y colaborativo, en el que la IA puede ejecutar y resolver tareas de mayor complejidad de forma más eficiente.
Introducing our most advanced Gemini Audio models yet 🗣
Gemini 3.8 Live and 3.8 Live Extended Thinking let you speak, collaborate, and execute tasks seamlessly, meaning conversing with AI just got a lot more natural.
So, what’s the difference between these two models? Let’s… pic.twitter.com/Dfy7j4zxOh
— Google AI (@GoogleAI) September 15, 2026
Gemini 3.8 Live está optimizado para la interacción cotidiana y fluida, ya que ha sido diseñado para ser rápido, económico y eficiente. El modelo cuenta con una base visual sólida que le permite procesar las entradas visuales prácticamente en tiempo real, lo que suma la información del contexto a su sistema y favorece que arroje respuestas y resultados más adecuados.
Ofrece una conversación fluida, pudiendo manejar interrupciones a mitad de frase, y es capaz de detectar hasta 97 idiomas, pudiendo saltar de una lengua compatible a otra en una misma conversación si el usuario o usuaria lo necesita. Además, es multitarea, ya que, mientras conversa, puede ejecutar herramientas y llamadas a la API en un segundo plano para cumplir con los trabajos y peticiones que se le mandan.
Quién puede utilizar Gemini 3.8 LiveGoogle ya ha comenzado a activar Gemini 3.8 Live en la API de Gemini y en Google AI Studio para desarrolladores, en la vista previa privada de Gemini Enterprise para empresas y en Search Live para el público general.
Así mismo, la tecnológica ha anunciado que la versión 3.8 Live también llegará próximamente a la experiencia del cliente en Gemini Enterprise, aunque no ha dado una fecha concreta.
Gemini 3.8 Live Extended ThinkingPor su parte, Gemini 3.8 Live Extended Thinking está ideado para un uso en tareas de elevada complejidad que requieren una mayor inteligencia y un razonamiento más profundo en múltiples pasos. Este modelo es capaz de mantener conversaciones fluidas e ininterrumpidas a la vez que ejecuta flujos de trabajo complejos. Además, también procesa y comprende la información visual en pocos segundos.
Mientras trabaja, emite “señales verbales tempranas como «Déjame comprobar esto…» para confirmar las indicaciones de forma natural y una narración en tiempo real que guía a los usuarios a través de tareas en segundo plano de varios pasos a medida que avanzan“, explica Google.
Quién puede utilizar Gemini 3.8 Live Extended ThinkingGemini 3.8 Live Extended Thinking ya se encuentra disponible para desarrolladores en la API de Gemini y en Google AI Studio. Mientras que las empresas pueden acceder al modelo a través de una vista previa privada en Gemini Enterprise (próximamente también se activará en Gemini Enterprise para clientes empresariales de Customer Experience y Google Workspace).
Sumado a esto, ya está disponible para el público general en Gemini Live, para los suscriptores de Google AI Pro y Ultra en Workspace en Docs, y para todos los suscriptores de Google AI en Gmail y Keep.
Marca de agua SynthIDTodo el audio generado por estos modelos de Gemini Live incluye SynthID, una marca de agua digital imperceptible para el oído humano integrada directamente en la salida de audio, lo que permite verificar e identificar cuándo un archivo de voz ha sido generado por la IA de Google.
SynthID no es exclusiva de Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, sino que se integra en otros productos de IA de Google como Nano Banana o VEO3.
Foto: Google