← नवीनतम पेपर
🤖 AI

U-Define: Designing User Workflows for Hard and Soft Constraints in LLM-Based Planning

यह शोध पत्र U-Define प्रस्तुत करता है, जो एक ऐसा सिस्टम है जो उपयोगकर्ताओं को बाधाओं (constraints) को सख्त "हार्ड" नियमों या लचीली "सॉफ्ट" प्राथमिकताओं के रूप में वर्गीकृत करने की अनुमति देकर LLM-आधारित योजना (planning) पर उपयोगकर्ता के नियंत्रण को बढ़ाता है, जिन्हें विश्वसनीयता, उपयोगिता और उपयोगकर्ता संतुष्टि में सुधार करने के लिए पूरक औपचारिक मॉडल चेकिंग और LLM-as-judge विधियों के माध्यम से सत्यापित किया जाता है।

मूल लेखक: Christine P Lee, Xinyu Jessica Wang, Aws Albarghouthi, David Porfirio, Bilge Mutlu

प्रकाशित 2026-05-06
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Christine P Lee, Xinyu Jessica Wang, Aws Albarghouthi, David Porfirio, Bilge Mutlu

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक आदर्श पारिवारिक अवकाश (वेकेशन) की योजना बनाने की कोशिश कर रहे हैं। आपके पास चीजों की एक सूची है जो होनी ही चाहिए (जैसे कि "हमें अपने बजट के भीतर रहना ही होगा" या "बच्चों को पूल में लाइफ जैकेट पहननी ही चाहिए") और चीजें हैं जिनकी आप दिल से कामना करते हैं (जैसे कि "हमें एक शांत समुद्र तट पसंद आएगा" या "किसी संग्रहालय को देखना अच्छा होगा")।

अतीत में, जब लोगों ने AI (लार्ज लैंग्वेज मॉडल्स) से इस यात्रा की योजना बनाने के लिए कहा, तो AI बस अनुमान लगा लेता था। यह लाइफ जैकेट को भूल सकता था क्योंकि वह बहुत रचनात्मक होने की कोशिश में व्यस्त था, या यह ऐसा होटल सुझा सकता था जिसकी कीमत बहुत अधिक हो। AI एक बहुत ही प्रतिभाशाली, लेकिन थोड़े बिखरे हुए दिमाग वाले ट्रैवल एजेंट की तरह है जो धाराप्रवाह बोलता तो है लेकिन हमेशा सख्त नियमों को नहीं सुनता।

समस्या:
वर्तमान AI उपकरण या तो बहुत कठोर (नियम सेट करने के लिए जटिल कोड का उपयोग करने के लिए मजबूर करना) हैं या बहुत ढीले (आपके नियमों को पूरी तरह से अनदेखा करना) हैं। उपयोगकर्ता अपने काम की मैन्युअल रूप से जांच करने में फंसे हुए थे, जो थका देने वाला और त्रुटियों के प्रति संवेदनशील था।

समाधान: U-Define
शोधकर्ताओं ने U-Define नामक एक नया सिस्टम बनाया है। इसे एक "डबल-चेक सिस्टम के साथ स्मार्ट ट्रैवल एजेंट" के रूप में समझें। केवल AI से "यात्रा की योजना बनाने" के लिए कहने के बजाय, U-Define आपको यह बताने देता है कि कौन से नियम Hard (कठोर) हैं और कौन से Soft (लचीले) हैं।

यह इस प्रकार काम करता है, सरल उपमाओं का उपयोग करते हुए:

1. नियमों के दो बाल्टी (Buckets)

U-Define आपसे अपने निर्देशों को दो बाल्टियों में छाँटने के लिए कहता है:

  • "Hard" बाल्टी (ईंट की दीवार): ये गैर-परक्राम्य (non-negotiable) नियम हैं। यदि AI इनमें से एक भी नियम तोड़ता है, तो योजना बेकार है।
    • उदाहरण: "हमें शाकाहारी भोजन ही करना चाहिए।"
    • जादू: U-Define आपके अंग्रेजी वाक्य को तुरंत एक सख्त, गणितीय "कोड" (जिसे LTL/PRISM कहा जाता है) में बदल देता है जिसे एक कंप्यूटर पूरी तरह से चेक कर सकता है। यह आपके नियम को एक सुरक्षा कैमरे में बदलने जैसा है जो कभी पलक नहीं झपकाता। यदि योजना में स्टेक (मांस) शामिल है, तो कैमरा तुरंत "ERROR!" चिल्लाएगा।
  • "Soft" बाकी (इच्छा सूची): ये प्राथमिकताएं हैं। यदि AI इन्हें मिस कर देता है, तो योजना अभी भी ठीक है, बस एकदम परफेक्ट नहीं है।
    • उदाहरण: "हम एक आरामदायक गति पसंद करेंगे।"
    • जादू: इनके लिए, U-Define एक दूसरे AI (एक "जज") का उपयोग करता है जो योजना को पढ़ता है और उसे स्टार रेटिंग (1 से 5 स्टार) और आपके 'वाइब' से यह कितना मेल खाता है, इस पर टिप्पणी देता है।

2. वर्कफ़्लो: आप कैसे इंटरैक्ट करते हैं

कल्पना कीजिए कि आप U-Define के साथ एक कंप्यूटर पर बैठे हैं:

  1. आप बोलते हैं: आप टाइप करते हैं, "वेनिस की यात्रा की योजना बनाएं।" आप अपने Hard नियम (लाइफ जैकेट, शाकाहारी भोजन) और Soft नियम (आरामदायक गति, बच्चों के लिए मज़ेदार) जोड़ते हैं।
  2. अनुवादक (The Translator): सिस्टम गुप्त रूप से आपके "Hard" नियमों को उस सख्त गणितीय कोड में बदल देता है। यह सुनिश्चित करने के लिए कि इसने आपको सही समझा है, यह अनुवाद को आपको दिखाता है।
  3. जेनेरेटर (The Generator): मुख्य AI तीन अलग-अलग यात्रा योजनाएं बनाता है।
  4. डबल-चेक:
    • मैथ कंप्यूटर Hard नियमों की जांच करता है। वह कहता है: "योजना A विफल रही क्योंकि इसमें लाइफ जैकेट पैक नहीं की गई थी। योजना B ने सभी Hard नियमों को पास कर लिया।"
    • जज AI Soft नियमों की जांच करता है। वह कहता है: "योजना B को 4 स्टार मिले क्योंकि यह आरामदायक थी, लेकिन योजना C को 5 स्टार मिले क्योंकि इसमें अधिक मनोरंजक गतिविधियाँ थीं।"
  5. परिणाम: आप योजनाओं को रैंक किए हुए देखते हैं। आप निश्चित रूप से जानते हैं कि शीर्ष योजनाएं आपके "अनिवार्य" नियमों को नहीं तोड़ेंगी, और आप देख सकते हैं कि कौन सी योजना आपकी "इच्छाओं" के लिए सबसे अच्छी है।

3. शोधकर्ताओं ने क्या पाया

टीम ने आम लोगों (जैसे छुट्टियों की योजना बनाने वाले माता-पिता) और विशेषज्ञों (जैसे निर्माण प्रबंधक या अनुदान समन्वयक) के साथ इसका परीक्षण किया।

  • आम लोगों को यह बहुत पसंद आया: उन्हें बहुत अधिक आत्मविश्वास महसूस हुआ। उन्हें त्रुटियों को खोजने के लिए "जासूस" खेलने की आवश्यकता नहीं थी। उन्हें पसंद आया कि वे "क्या करना है" और "क्या अच्छा होगा" के बीच अंतर कर सकते थे। उन्हें लगा कि AI आखिरकार एक नियम और एक सुझाव के बीच के अंतर को समझ गया है।
  • "Hard" नियम शक्तिशाली हैं: जब सिस्टम ने गारंटी दी कि Hard नियमों का पालन किया गया है, तो लोगों ने AI पर बहुत अधिक भरोसा किया। वे Soft नियमों की कुछ छोटी कमियों को स्वीकार करने के लिए तैयार थे, लेकिन यदि कोई Hard नियम टूट जाता, तो वे बहुत नाखुश होते।
  • "Soft" नियम लचीले हैं: लोगों ने योजना को ठीक करने के लिए Soft नियमों का उपयोग किया। हालांकि, उन्होंने गौर किया कि Soft नियमों के लिए AI की "स्टार रेटिंग" हमेशा सटीक नहीं थी, इसलिए उन्हें अभी भी खुद योजना को देखने की आवश्यकता थी।
  • विशेषज्ञों को अधिक मदद चाहिए थी: विशेषज्ञों ने (जिनके पास बहुत जटिल काम होते हैं) सिस्टम को पसंद किया लेकिन उनके कई नियमों को टाइप करने में उन्हें कठिनाई हुई। वे चाहते थे कि सिस्टम उनके सामान्य नियमों को याद रखे या स्प्रेडशीट से उन्हें इम्पोर्ट कर सके ताकि उन्हें हर बार सब कुछ शुरू से टाइप न करना पड़े।

मुख्य निष्कर्ष

पेपर यह निष्कर्ष निकालता है कि योजना बनाने के लिए AI वास्तव में उपयोगी होने के लिए, इसे आपको यह तय करने की अनुमति देनी चाहिए कि क्या एक सख्त नियम है और क्या एक लचीली प्राथमिकता है।

  • Hard Constraints (कठोर बाधाएं) = घर की नींव (मजबूत होनी चाहिए)।
  • Soft Constraints (लचीली बाधाएं) = पेंट और सजावट (पसंद के अनुसार बदला जा सकता है)।

उपयोगकर्ताओं को यह स्पष्ट रूप से बताने का तरीका देकर कि क्या एक सख्त नियम है और क्या एक लचीली प्राथमिकता है, और इन दोनों को चेक करने के लिए अलग-अलग "टूल्स" का उपयोग करके (हार्ड चीज़ों के लिए गणित, सॉफ्ट चीज़ों के लिए दूसरा AI), U-Define AI प्लानिंग को उसकी रचनात्मकता खोए बिना अधिक विश्वसनीय बनाता है। यह AI को एक "ब्लैक बॉक्स" से बदल देता है जो अनुमान लगाता है, एक "सहयोगी साथी" में बदल देता है जो आपकी सीमाओं का सम्मान करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →