Ugrás a fő tartalomra
Vissza a hírekhez
AI Tools

A Google elindítja a Gemini 3.8 Live és a 3.5 Transcribe modelleket

A Google hozzáadta a Gemini 3.8 Live‑t, a 3.8 Live Extended Thinking‑t és a Gemini 3.5 Transcribe‑t az API-jához, bővítve a valós‑idő hangfejlesztési eszközöket.

Közzétéve: 2026. szeptember 15.Szerző GetAISet Editorial

Az eredeti forrás közzétételi dátuma: 2026. szeptember 15.

Google bejelentette, hogy a Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking most már elérhető a Gemini API-n és a Google AI Studio-n keresztül. A modellek támogatják az aszinkron függvényhívást, a vizuális kontextust, az alfanumerikus pontosságot, a 97+ nyelvre kiterjedő többnyelvű lefedettséget, valamint az inkrementális tartalomfrissítéseket. Az Extended Thinking konfigurálható érvelést ad hozzá összetett, többlépéses feladatokhoz. Az árak $0.005 percenként a hangbemenetre és $0.018 percenként a hangkimenetre, a modellek a Live API-n és integrációs partnereken keresztül érhetők el, mint az Agora, a Fishjam, a LiveKit, a LangChain, a Pipecat, a Vercel és a Vision Agents. A Gemini 3.5 Transcribe, amely a múlt hónapban jelent meg, streaming átiratot biztosít 4,0% szószintű hibaaránnyal (2,6% nem streaming) több mint 85 nyelven, automatikus kódkapcsolással, egyedi szókincs‑elfordulással akár 1 000 kifejezésig, valamint egy intelligens átirat‑móddal, amely formázza és tisztítja a kimenetet. Ezek a kiegészítések új építőelemeket adnak a fejlesztőknek a hang‑első alkalmazásokhoz, a valós‑idő feliratozáshoz és a hang‑analitikához.