Saltar al contenido principal
Volver a Noticias
AI Tools

Google lanza los modelos Gemini 3.8 Live y 3.5 Transcribe

Google añadió Gemini 3.8 Live, 3.8 Live Extended Thinking y Gemini 3.5 Transcribe a su API, ampliando las herramientas de desarrollo de voz en tiempo real.

Publicado: 15 de septiembre de 2026Por GetAISet Editorial

Publicación de la fuente original: 15 de septiembre de 2026

Google anunció que Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking ya están disponibles a través de la API Gemini y Google AI Studio. Los modelos admiten llamadas asíncronas a funciones, contexto visual, precisión alfanumérica, cobertura multilingüe para más de 97 idiomas y actualizaciones incrementales de contenido. Extended Thinking agrega razonamiento configurable para tareas complejas de varios pasos. Los precios se listan en $0.005 por minuto para entrada de audio y $0.018 por minuto para salida de audio, y los modelos pueden accederse mediante la Live API y socios de integración como Agora, Fishjam, LiveKit, LangChain, Pipecat, Vercel y Vision Agents. Gemini 3.5 Transcribe, lanzado el mes anterior, ofrece transcripción en streaming con una tasa de error de palabras del 4.0 % (2.6 % sin streaming) en más de 85 idiomas, cambio automático de código, sesgo de vocabulario personalizado para hasta 1,000 términos y un modo de transcripción inteligente que formatea y limpia la salida. Estas incorporaciones brindan a los desarrolladores nuevos bloques de construcción para aplicaciones centradas en voz, subtitulado en tiempo real y análisis de audio.