Think Short, Defer Smart, Act, and Repeat: Calibrated Reasoning and Uncertainty-Aware Deferral for Edge LLM Agents
تقترح الورقة البحثية إطار عمل "فكر باختصار، وأجّل بذكاء" (TSDS)، وهو مخصص لوكلاء النماذج اللغوية الكبيرة (LLMs) على الحافة، والذي يعمل على تحسين الإنهاء المبكر للاستنتاج والتأجيل السحابي المدرك لعدم اليقين بشكل مشترك عبر إجراء تعلم متعدد الأهداف ومعاير، مما يقلل بشكل كبير من الحوسبة على الجهاز مع الحفاظ على ضمانات الأداء الموثوق والموثوقية عبر مختلف مهام الاستنتاج والتخطيط.