انتقل إلى المحتوى الرئيسي
العودة إلى الأخبار
AI Tools

إطلاق تقييمات Amazon Bedrock AgentCore لاختبارات مستقلة عن الإطار البرمجي

تتيح تقييمات Amazon Bedrock AgentCore الآن للمطورين تقييم وكلاء الذكاء الاصطناعي بغض النظر عن الإطار البرمجي الأساسي باستخدام بيانات OpenTelemetry.

نُشر: 26 أغسطس 2026بقلم GetAISet Editorial

تاريخ نشر المصدر الأصلي: 26 أغسطس 2026

قدمت أمازون خدمة Amazon Bedrock AgentCore Evaluations، وهي خدمة مصممة لمعالجة التشتت في تقييم وكلاء الذكاء الاصطناعي. في السابق، كانت أدوات التقييم تتطلب غالباً حزم تطوير برمجية (SDKs) أو أنماط تتبع محددة، مما يحد من توافقها مع أطر عمل الوكلاء المتنوعة. تعمل هذه الخدمة الجديدة على فصل التقييم عن الإطار البرمجي المستخدم من خلال الاستفادة من OpenTelemetry كلغة مشتركة لجمع التتبعات والمقاييس والسجلات. من خلال استخدام أدوات OpenTelemetry أو OpenInference، يمكن للخدمة إعادة بناء جلسات الوكيل وتقييمها باستخدام مقيمين مثل GoalSuccessRate وCorrectness. يقوم النظام تلقائياً بتصنيف النطاقات لاستخراج البيانات الضرورية، بما في ذلك مطالبات المستخدم، واستجابات النموذج، وتفاصيل تنفيذ الأداة. يدعم هذا النهج أطر عمل متنوعة، بما في ذلك LangGraph وLlamaIndex وOpenAI Agents SDK، دون الحاجة إلى إجراء تغييرات على كود الوكيل الحالي. تم تصميم الخدمة لتكون متوافقة مع المستقبل، مما يسمح لها بمعالجة أنواع نطاقات جديدة مع تطور أطر العمل مع تجاهل السياق غير ذي الصلة.