انتقل إلى المحتوى الرئيسي
العودة إلى الأخبار
AI Tools

Google تطلق نماذج Gemini 3.8 Live و3.5 Transcribe

أضافت Google Gemini 3.8 Live و3.8 Live Extended Thinking وGemini 3.5 Transcribe إلى واجهة برمجة التطبيقات الخاصة بها، موسعةً أدوات تطوير الصوت في الوقت الحقيقي.

نُشر: 15 سبتمبر 2026بقلم GetAISet Editorial

تاريخ نشر المصدر الأصلي: 15 سبتمبر 2026

أعلنت Google أن Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking متاحان الآن عبر Gemini API وGoogle AI Studio. تدعم النماذج استدعاء الدوال غير المتزامن، والسياق البصري، والدقة الحرفية الرقمية، وتغطية متعددة اللغات لأكثر من 97 لغة، وتحديثات محتوى تدريجية. يضيف Extended Thinking قدرة التفكير القابلة للتكوين للمهام المعقدة متعددة الخطوات. تم تحديد الأسعار بـ 0.005 دولار لكل دقيقة لإدخال الصوت و0.018 دولار لكل دقيقة لإخراج الصوت، ويمكن الوصول إلى النماذج عبر Live API وشركاء التكامل مثل Agora وFishjam وLiveKit وLangChain وPipecat وVercel وVision Agents. قدم Gemini 3.5 Transcribe، الذي صدر الشهر السابق، نسخًا متدفقة مع معدل خطأ كلمة بنسبة 4.0٪ (2.6٪ غير المتدفقة) عبر أكثر من 85 لغة، وتبديل تلقائي للغات، وتخصيص مفردات حتى 1,000 مصطلح، ووضع نسخ ذكي ينسق وينظف المخرجات. تمنح هذه الإضافات المطورين مكوّنات بناء جديدة لتطبيقات الصوت أولاً، والترجمة الفورية في الوقت الحقيقي، وتحليلات الصوت.