#1
هل الوكلاء يقدروا يتعاملوا مع العالم المفتوح؟ – OpenAgent
Can Agents Generalize to the Open World? Unveiling the Fragility of Static Training in Tool Use
الفريق قدموا فكرة OpenAgent، وهي إعداد لتدريب وكلاء أداة في بيئة مفتوحة فيها تغيّر بالاستفسارات، الأدوات، وطريقة التفاعل. جربوا شغلة بيئة محكمة فيها أربع مستويات من التغيّر: الإدراك، التفاعل، التفكير، والدمج الداخلي، ولاحظوا إن الوكلاء المدربين بـ Supervised Fine-Tuning أو Reinforcement Learning بينخفض أداؤهم مع هالتغيّرات. بناءً على هالنتايج، اقترحوا طريقة Perturbation-Augmented Fine-Tuning لتقوية الوكلاء ضد الاضطرابات. الكود رح يطلع على GitHub قريباً.
ليش بتهمّك؟: هالورقة بتظهر كيف نقدر نجعل الوكلاء أكثر صلابة بالواقع المتغيّر، مش بس بالمختبرات الثابتة.
🌱 شو إلك منها؟
تخيل إنك تتعامل مع برنامج ذكي يقدر يستخدم أدوات مختلفة حسب طلبك، بس إذا تغيرت الأدوات أو طريقة السؤال، البرنامج يطيق يشتغل. هالبحث بيقترح طريقة لتقوية هالبرامج حتى يظلوا يشتغلوا كويس حتى لو الدنيا تغيرت. ممكن تشوف هالتحسينات في تطبيقات المساعدة الذكية أو الروبوتات المنزلية اللي تتعامل مع أوضاع جديدة كل يوم.