Google DeepMind lanza Gemini 3.8 Live y Extended Thinking
Google DeepMind anunció Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, modelos centrados en la voz que añaden contexto visual en tiempo real y ejecución de herramientas en segundo plano.
Publicación de la fuente original: 15 de septiembre de 2026
Google DeepMind presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking como sus modelos de diálogo en vivo más avanzados. Ambos modelos ahora son accesibles a través de la API de Gemini, Google Workspace y la aplicación Gemini, lo que permite a los usuarios iniciar interacciones de voz de inmediato.
Gemini 3.8 Live admite conversaciones rápidas y fluidas con entrada visual casi en tiempo real y puede cambiar entre 97 idiomas durante el diálogo. Gemini 3.8 Live Extended Thinking añade razonamiento de orden superior para tareas complejas y de varios pasos, manteniendo la conversación sin interrupciones y ejecutando herramientas y llamadas a API en segundo plano.
Para desarrolladores y empresas, los modelos están disponibles mediante la API Gemini Live y están integrados con plataformas como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel y Vision Agents. Todo el audio generado incluye una marca de agua SynthID imperceptible para trazabilidad.