ASK in the Dark: Uncertainty-Gated LLM Assistance under Partial Observability
यह शोध पत्र ASK+ प्रस्तुत करता है, जो एक ऐसा ढांचा है जो अप्रभावी नग्न प्रॉम्प्ट्स (bare prompts) को प्रक्षेपवक्र-जागरूक संदर्भ (trajectory-aware context) और चेन-ऑफ-थॉट रीजनिंग से बदलकर आंशिक रूप से दृश्य वातावरण (partially observable environments) में सुदृढीकरण सीखने (reinforcement learning) वाले एजेंटों को बेहतर बनाता है, जिससे छोटे भाषा मॉडलों को अर्थपूर्ण, अनिश्चितता-गेटेड मार्गदर्शन प्रदान करने में सक्षम बनाया जा सके जो वैनिला दृष्टिकोणों की तुलना में काफी बेहतर प्रदर्शन करता है और बड़े मॉडलों की आवश्यकता के बिना कुशलतापूर्वक स्केल होता है।