Alibaba تُصدر نموذج Qwen3.8‑2.4T مفتوح الوزن؛ AWS تُظهر نشر SageMaker HyperPod
نموذج Qwen3.8‑2.4T‑A95B من Alibaba أصبح الآن مفتوح الوزن، وتقدم AWS دليلًا لتشغيله على SageMaker HyperPod باستخدام vLLM وتقليل الدقة NVFP4.
تاريخ نشر المصدر الأصلي: 9 سبتمبر 2026
في 12 أغسطس 2026 أصدرت فريق Qwen التابع لشركة Alibaba نموذج Qwen3.8‑2.4T‑A95B، أول نموذج مفتوح الوزن في فئة Qwen‑Max. يحتوي على 2.4 تريليون معامل إجمالي، و95 مليار معامل مفعَّل لكل رمز، وتصميم هجين يجمع بين الانتباه الخطي والكامل، وسياق أصلي بسعة 262 K رمز يمكن تمديده إلى 1 M رمز. يستهدف النموذج أعباء العمل الوكيلة مثل الترميز متعدد الخطوات، التخطيط طويل الأمد واستخدام الأدوات المستقلة.
توضح AWS كيفية خدمة النموذج على Amazon SageMaker HyperPod باستخدام vLLM على مثيل ml.p6‑b300 يحتوي على ثمانية وحدات معالجة رسومية NVIDIA B300 Blackwell Ultra. يقلل استخدام تقليل الدقة NVFP4 (W4A4) من حجم الوزن إلى حوالي 1.2 TB، مما يتناسب مع ذاكرة GPU بسعة 2.1 TB في العقدة. يقوم مشغل الاستدلال HyperPod بأتمتة تنزيل النموذج، جدولة الحاويات، فحوصات الصحة وتوسيع السعة تلقائيًا، بينما تمكّن علامات vLLM من التوازي المتجهي، التخزين المؤقت للبادئات، تحليل الاستدلال والتنبؤ المتعدد الرموز الأصلي.