Ugrás a fő tartalomra
Vissza a hírekhez
AI Tools

A Google DeepMind elindítja a Gemini 3.8 Live és Extended Thinking modelleket

A Google DeepMind bejelentette a Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking modelleket, hang‑első modelleket, amelyek valós idejű vizuális alapozást és háttérben futó eszközök végrehajtását adják hozzá.

Közzétéve: 2026. szeptember 15.Szerző GetAISet Editorial
Forrás: Google DeepMindEredeti cikk megtekintése

Az eredeti forrás közzétételi dátuma: 2026. szeptember 15.

A Google DeepMind bemutatta a Gemini 3.8 Live és a Gemini 3.8 Live Extended Thinking modelleket, mint a legfejlettebb élő párbeszédmodelleket. Mindkét modell mostantól elérhető a Gemini API-n, a Google Workspace-en és a Gemini alkalmazáson keresztül, lehetővé téve a felhasználók számára, hogy azonnal hanginterakciókat indítsanak.

A Gemini 3.8 Live gyors, folyékony beszélgetéseket támogat közel valós idejű vizuális bemenettel, és képes a 97 nyelv között váltani a párbeszéd közben. A Gemini 3.8 Live Extended Thinking magasabb szintű érvelést ad hozzá összetett, több lépéses feladatokhoz, miközben a beszélgetést megszakítás nélkül tartja, és a háttérben eszközöket és API-hívásokat hajt végre.

Fejlesztők és vállalkozások számára a modellek a Gemini Live API-n keresztül érhetők el, és integrálva vannak olyan platformokkal, mint az Agora, a Fishjam, a LangChain, a LiveKit, a Pipecat, a Vercel és a Vision Agents. Minden generált hang tartalmaz egy észrevehetetlen SynthID vízjelet a nyomon követhetőség érdekében.