
اختبر السلوك
Agent
Wind Tunnel
اختبار يوضح كيف يتعامل مساعد الذكاء الاصطناعي مع المشكلات.
أعطِ مساعد الذكاء الاصطناعي المهمة نفسها مرتين: مرة بأدوات تعمل بشكل طبيعي، ومرة مع مشكلة مقصودة. يوضح تقرير مقارن كيف تغيّرت استجابته، ليساعدك على اكتشاف نقاط الضعف.
كيف يعمل
تبدأ كل تجربة بحالة جديدة للوكيل. يُدرج عطل عند استدعاء محدد لإحدى الأدوات، ويسجل النظام الطلبات والملاحظات والإجابات النهائية وما إذا كان التنفيذ قد وصل إلى العطل.
- حالات الاختبار
- أخطاء مؤقتة في الأدوات، ونتائج قديمة، وتعليمات غير موثوقة داخل استجابة أداة.
- المخرجات
- سجلات بصيغة JSON، وملخص مقارن للتجربتين، وتقرير HTML. تُحسب نسبة النجاح من المقارنات الصالحة فقط.
يستخدم العرض المحلي قرارات مبرمجة وبيانات اختبار ثابتة. ويمكن لمحوّل OpenAI اختياري ربط استدعاءات فعلية للأدوات بسير العمل نفسه.