#1
التوقف الذكي للوكيل: متى يوقف الـLLM عن الفعل؟
Agentic Abstention: Do Agents Know When to Stop Instead of Act?
الوكيل المبني على LLM لازم يشتغل على عدة جولات، يستخدم بحث على الويب، واجهات تصفح، أو أدوات الطرفية ليحقق هدف المستخدم. بس مش كل هدف واضح أو ممكن بالبيئة المتوفرة، فهنا بيجي مفهوم Agentic Abstention، يعني متى يقرر الوكيل يوقف ويتوقف عن استدعاء الأدوات. الباحثين جربوا هالمشكلة على مهام التسوق على الويب، والبيئات الطرفية، وأسئلة وإجابات، وقيّموا 13 نظام وكيل و2 هياكل وكيل على أكثر من 28,000 مهمة، ولاحظوا إن التحدي الأكبر مش بس إن الوكيل يقدر يوقف، بل متى يوقف بالضبط. بعدين قدموا طريقة CONVOLVE لهندسة السياق، اللي حسّنت توقيت الإيقاف بشكل كبير بدون تعديل وزن النموذج، خصوصًا لـ Llama-3.3-70B.
ليش بتهمّك؟: هالنتائج بتخلينا نطور وكلاء أكثر أمانًا وفعالية، ما بيضيعوا وقت المستخدمين ولا يخلوا النظام يشتغل بلا فائدة.
🌱 شو إلك منها؟
تخيّل إنك تسأل مساعد صوتي عن مطعم، وهو ما يلاقي شي مناسب، بدال ما يظل يدور ويضيع وقتك، يوقف ويخبرك إن ما في نتيجة. هالطريقة بتخلي التطبيقات اليومية، مثل الشات بوت أو المساعدين الذكيين، تكون أسرع وأدق. رح تشوف الفرق لما تستعمل خدمة بتعرف متى تقول "ما بعرف" بدل ما تستمر تحاول تحل المشكلة بلا فائدة.