مصطلحًا
نافذة السياق (Context Window)
- الفئة
- LLMs & Generative AI
- الصعوبة
- متوسط
التعريف
نافذة السياق هي الحد الأقصى لعدد الرموز (Tokens) - التي تمثل كلمات أو أجزاء من كلمات - التي يمكن لنموذج لغوي كبير معالجتها ومراعاتها في وقت واحد خلال تمريرة استنتاج واحدة.
آلية العمل والسياق
تعمل نافذة السياق كحد تشغيلي لمدخلات ومخرجات النماذج اللغوية الكبيرة (LLM). عندما تقدم أمراً (Prompt)، يقوم النموذج بتحويل ذلك النص إلى رموز. تتضمن نافذة السياق كلاً من مدخلاتك (الأمر) واستجابة النموذج المولدة. بمجرد أن يتجاوز عدد الرموز الإجمالي الحد المحدد مسبقاً للنموذج، يجب على النموذج "نسيان" الأجزاء الأولى من المحادثة أو المستند لإفساح المجال لبيانات جديدة. غالباً ما تتم إدارة ذلك من خلال تقنيات النافذة المنزلقة أو الاقتطاع. لقد وسعت النماذج الحديثة هذه النوافذ بشكل كبير، من بضعة آلاف من الرموز إلى الملايين. ومع ذلك، لا تضمن النافذة الأكبر دائماً استرجاعاً مثالياً؛ فقد تعاني النماذج من ظاهرة "الضياع في المنتصف"، حيث تجد صعوبة في استرجاع المعلومات المدفونة في وسط مستند ضخم مقارنة بالمعلومات الموجودة في البداية أو النهاية.
لماذا هو مهم
تحدد نافذة السياق قدرة النموذج على التعامل مع المهام المعقدة مثل تلخيص كتب كاملة، أو تحليل قواعد برمجية ضخمة، أو الحفاظ على تماسك المحادثة على المدى الطويل. تسمح النافذة الأكبر بـ "تعلم داخل السياق" أكثر شمولاً، حيث يمكن للنموذج الرجوع إلى وثائق واسعة أو سجل المستخدم دون الحاجة إلى ضبط دقيق. يعد فهم هذا الحد أمراً بالغ الأهمية للمطورين الذين يبنون أنظمة التوليد المعزز بالاسترجاع (RAG)، حيث يحدد مقدار المواد المصدرية التي يمكن تغذيتها للنموذج في وقت واحد.
مثال واقعي
تخيل شركة محاماة تستخدم ذكاءً اصطناعياً لتحليل عقد مكون من 500 صفحة. إذا كان العقد يحتوي على 150,000 رمز وكان لدى نموذج الذكاء الاصطناعي نافذة سياق بسعة 128,000 رمز، فلا يمكن للنموذج معالجة المستند بالكامل دفعة واحدة. يجب على المستخدم إما تقسيم المستند إلى أجزاء أصغر أو استخدام نظام استرجاع لتغذية الأقسام الأكثر صلة فقط في النافذة، وإلا سيقوم النموذج باقتطاع بداية العقد وتفويت بنود حاسمة.
أخطاء شائعة
- افتراض أن نافذة السياق الأكبر تعني أن النموذج سيتذكر كل تفصيل داخل تلك النافذة بشكل مثالي.
- الخلط بين نافذة السياق والذاكرة طويلة المدى للنموذج أو بيانات التدريب؛ نافذة السياق مؤقتة وتتم إعادة تعيينها في كل جلسة.
- تجاهل أن نافذة السياق تتضمن مخرجات النموذج، مما يعني أن الأمر الطويل جداً يترك مساحة أقل لاستجابة الذكاء الاصطناعي.
- الاعتقاد بأن زيادة حجم نافذة السياق ليس لها أي تأثير على زمن الاستجابة أو التكلفة الحسابية.
الأسئلة الشائعة
هل تجعل نافذة السياق الأكبر النموذج أكثر ذكاءً؟
لا. نافذة السياق الأكبر تزيد فقط من كمية المعلومات التي يمكن للنموذج الاحتفاظ بها في ذاكرة العمل الفورية الخاصة به. وهي لا تحسن قدرات التفكير الأساسية للنموذج أو قاعدة معارفه.
ماذا يحدث عندما أتجاوز حد نافذة السياق؟
عادةً، سيقوم النموذج إما بإظهار خطأ، أو اقتطاع الأجزاء الأقدم من المحادثة، أو التوقف عن توليد النص. يعتمد السلوك المحدد على تنفيذ واجهة برمجة التطبيقات (API) أو الواجهة التي تستخدمها.
كيف ترتبط الرموز بالكلمات في نافذة السياق؟
الرموز ليست كلمات بالضبط. في اللغة الإنجليزية، الرمز الواحد يعادل تقريباً 0.75 كلمة. يمكن لنافذة سياق بسعة 100,000 رمز أن تحتوي على حوالي 75,000 كلمة، على الرغم من أن هذا يختلف بناءً على اللغة وطريقة الترميز المحددة التي يستخدمها النموذج.