Specifications for Humans, Agents, and Tooling
यह टूल पेपर बोस्के एपीआई (BAPI) इकोसिस्टम का परिचय देता है, जो एक पॉलीग्लॉट स्पेसिफिकेशन लैंग्वेज है जिसे स्पष्ट, सुस्पष्ट और विश्वसनीय स्पेसिफिकेशन के माध्यम से सॉफ्टवेयर विकास को बढ़ाने के लिए डिज़ाइन किया गया है जो एजेंटिक एआई सिस्टम के लिए टेस्ट जनरेशन, वैलिडेशन और सुरक्षा सहित पूर्ण एप्लिकेशन लाइफसाइकिल का समर्थन करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक बहुत ही बुद्धिमान, लेकिन थोड़े लापरवाह रोबोटिक सहायक को अपना बैंक खाता संभालने के लिए काम पर रख रहे हैं। आप उसे कहते हैं, "बिल का भुगतान करो," और वह उसे करने निकल जाता है। लेकिन क्या होगा अगर रोबोट "बिल" का मतलब आपकी पूरी जीवन भर की बचत समझ ले? या क्या होगा अगर वह अस्पष्ट निर्देशों के कारण गलती से गलत व्यक्ति को पैसे भेज दे?
यह शोध पत्र मनुष्यों और AI रोबोट दोनों को निर्देश देने का एक नया तरीका पेश करता है, जिसे BAPI (BOSQUE API) कहा जाता है। BAPI को केवल नियमों की एक सूची के रूप में नहीं, बल्कि एक अति-विस्तृत, अटूट अनुबंध (contract) के रूप में सोचें जिसमें अनुमान लगाने की कोई गुंजाइश न हो।
यहाँ यह शोध पत्र इसे सरल उपमाओं (analogies) का उपयोग करके समझाता है:
1. समस्या: अस्पष्ट निर्देश खतरनाक होते हैं
शोध पत्र एक खराब उदाहरण दिखाकर शुरुआत करता है: "खाता A से खाता B में पैसा स्थानांतरित करें।"
यह एक रोबोट को, "जाओ मेरे लिए कुछ खाने को लाओ" कहने जैसा है। यह बहुत अस्पष्ट है। रोबोट $10,000 का स्टेक खरीद सकता है, या वह उसके लिए भुगतान करने हेतु आपका बटुआ चुरा सकता है। AI एजेंटों (निर्णय लेने वाले रोबोट) की दुनिया में, अस्पष्ट निर्देश खतरनाक गलतियों की ओर ले जाते हैं।
2. समाधान: "गलती-मुक्त" ब्लूप्रिंट
लेखक एक नई भाषा (BAPI) प्रस्तावित करते हैं जो एक अस्पष्ट रेखाचित्र के बजाय एक लेगो (Lego) निर्देश पुस्तिका की तरह कार्य करती है।
- "पोके-योके" (Poke-Yoke) की अवधारणा: विनिर्माण (manufacturing) में, "पोके-योके" का अर्थ है चीजों को इस तरह डिजाइन करना कि आप उन्हें गलत तरीके से असेंबल नहीं कर सकते (जैसे एक USB-C प्लग जो केवल एक ही दिशा में फिट होता है)। BAPI सॉफ्टवेयर के लिए ऐसा ही करता है। यह आपको यह परिभाषित करने के लिए मजबूर करता है कि एक "यूजर आईडी" कैसी दिखनी चाहिए (जैसे, "केवल अक्षर और संख्याएं, 2 से 30 लंबी") ताकि सिस्टम किसी भी अजीब चीज़ को तुरंत खारिज कर दे।
- "गार्डरेल्स" (Guardrails): केवल "पैसे स्थानांतरित करें" कहने के बजाय, BAPI आपको गार्डरेल्स जोड़ने के लिए मजबूर करता है:
- तर्क (Logic): "राशि शून्य से अधिक और $100 से कम होनी चाहिए।"
- अनुमतियाँ (Permissions): "आप केवल इस विशिष्ट बैंक खाते को छू सकते हैं, पूरे बैंक को नहीं।"
- वातावरण (Environment): "आप यह केवल तभी कर सकते हैं जब आपकी जेब में एक विशेष 'प्राधिकरण टोकन' (Authorization Token) हो।"
3. "टाइम-ट्रैवल" लॉग
समय को संभालना इसकी सबसे शानदार विशेषताओं में से एक है।
कल्पiah कीजिए कि आप कहना चाहते हैं, "आप पैसा स्थानांतरित कर सकते हैं केवल तभी जब उपयोगकर्ता ने इस विशिष्ट लेनदेन के लिए पहले ही 'हाँ' कह दिया हो।"
पुराने सिस्टम इसमें संघर्ष करते हैं। BAPI एक अपरिवर्तनीय डायरी (इवेंट लॉग) का उपयोग करता है। रोबोट द्वारा कोई कदम उठाने से पहले, वह डायरी की जाँच करता है: "क्या इंसान ने पहले इसकी मंजूरी दी थी?" यदि डायरी खाली है, तो रोबोट रुक जाता है। यह रोबोट को उन चीजों के आधार पर निर्णय लेने से रोकता है जो अभी तक हुई नहीं हैं या जिन्हें भुला दिया गया है।
4. टूलबेल्ट: वे रोबोट जो खुद का परीक्षण करते हैं
शोध पत्र एक ऐसे उपकरणों के सेट का वर्णन करता है जो इस नई भाषा के साथ आते हैं:
- "स्ट्रेस-टेस्टर" (TECTON): कल्पना कीजिए कि एक रोबोट आपके निर्देशों को पढ़ता है और तुरंत उन्हें तोड़ने की कोशिश करता है, जैसे कि हजारों अजीब, किनारे वाले परिदृश्यों (edge-case scenarios) को उत्पन्न करना (जैसे नकारात्मक पैसा या बहुत बड़ी राशि स्थानांतरित करने का प्रयास करना)। यह कोड को इंसानों के देखने से पहले ही बग्स ढूंढ लेता है।
- "गणितीय प्रमाण" (SUNDEW): यह उपकरण एक सुपर-गणितज्ञ की तरह कार्य करता है। यह केवल यह अनुमान नहीं लगाता कि कोड काम करता है; यह इसे सिद्ध करता है। यह सुनिश्चित करने के लिए हर संभावित छोटे इनपुट की जाँच करता है कि रोबोट कभी कुछ खतरनाक न करे। यदि इसे कोई दोष मिलता है, तो यह आपको एक विशिष्ट उदाहरण देता है कि इसे कैसे तोड़ें ताकि आप इसे ठीक कर सकें।
5. उदाहरणों के साथ AI को सिखाना
कभी-कभी, एक आदर्श तार्किक नियम लिखना कठिन होता है। शोध पत्र निर्देशों में उदाहरण जोड़ने का सुझाव देता है, जैसे रोबोट को दिखाना: "यहाँ संख्याओं की एक सूची है: 3, 1, 2। यहाँ परिणाम है: 1, 2, 3।"
यह AI को तर्क (logic) के बिना इरादे (intent) को समझने में मदद करता है (जैसे सॉर्टिंग)। यह एक बच्चे को "कुत्ते" की जैविक परिभाषा बताने के बजाय उसे कुत्ते की तस्वीर दिखाने जैसा है।
मुख्य निष्कर्ष
शोध पत्र का तर्क है कि AI एजेंटों के साथ सुरक्षित रूप से काम करने के लिए, हमें अस्पष्ट विवरण लिखना बंद करना होगा और निष्पादन योग्य, सख्त अनुबंध (executable, strict contracts) लिखना शुरू करना होगा।
- पुराना तरीका: "यहाँ मेरी इच्छा का एक अस्पष्ट विचार है। शुभकामनाएँ, AI।"
- BAPI का तरीका: "यहाँ गार्डरेल्स, समय-जाँच और उदाहरणों के साथ एक सख्त, गणितीय रूप से सिद्ध अनुबंध है। यदि आप इसका पालन करते हैं, तो आप सुरक्षित हैं। यदि आप इसे तोड़ने की कोशिश करते हैं, तो सिस्टम आपको रोक देगा।"
लक्ष्य एक ऐसा सॉफ्टवेयर जगत बनाना है जहाँ AI एजेंट अत्यधिक प्रशिक्षित पायलटों की तरह हों जो विमान को पहाड़ से टकराने के लिए गलती नहीं कर सकते, क्योंकि उड़ान योजना (स्पेसिफिकेशन) इतनी स्पष्ट है और सुरक्षा प्रणालियाँ इतनी मजबूत हैं कि गलतियाँ करना शारीरिक रूप से असंभव है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।