مصطلحًا
رمز
- الفئة
- LLMs & Generative AI
- الصعوبة
- مبتدئ
التعريف
الرمز هو الوحدة الأساسية للنص التي تعالجها النماذج اللغوية الكبيرة (LLM)، ويمثل تسلسلاً من الأحرف، أو كلمة، أو جزءاً من كلمة.
آلية العمل والسياق
في بنية النماذج اللغوية الكبيرة الحديثة، لا تتم معالجة النص كسلاسل خام من الأحرف. بدلاً من ذلك، يخضع لعملية تسمى الترميز، حيث يتم تحويل المدخلات إلى تسلسل من المعرفات الرقمية المعروفة بالرموز. يمكن أن يمثل رمز واحد كلمة شائعة، أو جزءاً من كلمة، أو حتى حرفاً واحداً، اعتماداً على المرمز المحدد الذي يستخدمه النموذج. على سبيل المثال، قد يتم تقسيم كلمة 'unhappiness' إلى 'un' و'happi' و'ness'. يسمح نهج الكلمات الفرعية هذا للنماذج بالتعامل مع الكلمات النادرة، والأخطاء الإملائية، والهياكل المورفولوجية المعقدة بفعالية. يتم تحديد إجمالي عدد الرموز التي يمكن للنموذج معالجتها في وقت واحد من خلال 'نافذة السياق' الخاصة به، والتي تعمل كذاكرة قصيرة المدى للنموذج. يعد فهم الترميز أمراً بالغ الأهمية لأنه يؤثر بشكل مباشر على أداء النموذج، والتكاليف الحسابية، ودقة توليد المخرجات.
لماذا هو مهم
تعد الرموز المقياس الأساسي لكل من التكلفة والسعة في الذكاء الاصطناعي التوليدي. يعتمد تسعير واجهة برمجة التطبيقات (API) عالمياً تقريباً على عدد الرموز التي تمت معالجتها، ويحدد حجم نافذة سياق النموذج مقدار المعلومات التي يمكنه 'تذكرها' أثناء المحادثة. يجب على المطورين فهم حدود الرموز لمنع اقتطاع البيانات ولتحسين كفاءة مطالباتهم وتطبيقاتهم.
مثال واقعي
عندما ترسل مطالبة إلى ذكاء اصطناعي مثل ChatGPT، يقوم النظام أولاً بترميز مدخلاتك. إذا سألت، 'كم عدد الرموز الموجودة في هذه الجملة؟'، يقوم النموذج بتقسيم تلك الجملة إلى حوالي 10-12 رمزاً. إذا كنت تبني تطبيقاً باستخدام واجهة برمجة تطبيقات، فستتم محاسبتك بناءً على العدد الإجمالي لهذه الرموز لكل من مدخلاتك واستجابة النموذج المولدة، مما يجعل إدارة الرموز ضرورية للتحكم في الميزانية.
أخطاء شائعة
- افتراض أن رمزاً واحداً يساوي دائماً كلمة واحدة؛ في الواقع، يتم تقسيم العديد من الكلمات إلى رموز متعددة.
- تجاهل حد الرموز للنموذج، مما يؤدي إلى 'نسيان' الذكاء الاصطناعي لبداية محادثة طويلة.
- الاستهانة بتكلفة المطالبات الطويلة، حيث يتم محاسبة رموز المدخلات تماماً مثل رموز المخرجات.
- الاعتقاد بأن الترميز متطابق عبر جميع نماذج الذكاء الاصطناعي؛ تستخدم النماذج المختلفة مفردات واستراتيجيات ترميز مختلفة.
الأسئلة الشائعة
لماذا تستخدم النماذج رموز الكلمات الفرعية بدلاً من الكلمات الكاملة؟
يسمح استخدام رموز الكلمات الفرعية للنموذج بالتعامل مع مفردات لا نهائية. يمكنه بناء معنى الكلمات النادرة أو الجديدة من خلال الجمع بين أجزاء الكلمات الفرعية المعروفة، بينما سيفشل نظام قائم على الكلمات إذا واجه كلمة غير موجودة في قاموسه الثابت.
هل يمكنني حساب العدد الدقيق للرموز في نصي؟
نعم، يقدم معظم مزودي النماذج أدوات أو مكتبات 'مرمز' تسمح لك بإدخال نص ورؤية بالضبط كيف سيتم تقسيمه إلى رموز بواسطة مفردات ذلك النموذج المحدد.
هل يؤثر عدد الرموز على سرعة استجابة الذكاء الاصطناعي؟
نعم، لأن النماذج اللغوية الكبيرة تولد النص رمزاً واحداً في كل مرة. تتطلب الاستجابة الأطول خطوات توليد متسلسلة أكثر، مما يزيد من الوقت الإجمالي المستغرق لإكمال المخرج.