Google تطلق نماذج Gemini 3.8 Live و3.5 Transcribe
أضافت Google Gemini 3.8 Live و3.8 Live Extended Thinking وGemini 3.5 Transcribe إلى واجهة برمجة التطبيقات الخاصة بها، موسعةً أدوات تطوير الصوت في الوقت الحقيقي.
تاريخ نشر المصدر الأصلي: 15 سبتمبر 2026
أعلنت Google أن Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking متاحان الآن عبر Gemini API وGoogle AI Studio. تدعم النماذج استدعاء الدوال غير المتزامن، والسياق البصري، والدقة الحرفية الرقمية، وتغطية متعددة اللغات لأكثر من 97 لغة، وتحديثات محتوى تدريجية. يضيف Extended Thinking قدرة التفكير القابلة للتكوين للمهام المعقدة متعددة الخطوات. تم تحديد الأسعار بـ 0.005 دولار لكل دقيقة لإدخال الصوت و0.018 دولار لكل دقيقة لإخراج الصوت، ويمكن الوصول إلى النماذج عبر Live API وشركاء التكامل مثل Agora وFishjam وLiveKit وLangChain وPipecat وVercel وVision Agents. قدم Gemini 3.5 Transcribe، الذي صدر الشهر السابق، نسخًا متدفقة مع معدل خطأ كلمة بنسبة 4.0٪ (2.6٪ غير المتدفقة) عبر أكثر من 85 لغة، وتبديل تلقائي للغات، وتخصيص مفردات حتى 1,000 مصطلح، ووضع نسخ ذكي ينسق وينظف المخرجات. تمنح هذه الإضافات المطورين مكوّنات بناء جديدة لتطبيقات الصوت أولاً، والترجمة الفورية في الوقت الحقيقي، وتحليلات الصوت.