← नवीनतम पेपर
💻 computer science

Agent Contracts: A Formal Framework for Resource-Bounded Autonomous AI Systems

यह शोध पत्र "एजेंट कॉन्ट्रैक्ट्स" (Agent Contracts) प्रस्तुत करता है, जो एक औपचारिक ढांचा है जो टास्क स्पेसिफिकेशन को सख्त संसाधन, टेम्पोरल और सफलता संबंधी बाधाओं के साथ एकीकृत करके मल्टी-एजेंट सिस्टम को नियंत्रित करने के लिए कॉन्ट्रैक्ट नेट प्रोटोकॉल का विस्तार करता है, जिससे प्रदर्शित दक्षता और शून्य संरक्षण उल्लंघन के साथ पूर्वानुमानित, ऑडिट योग्य और संसाधन-बद्ध स्वायत्त एआई परिनियोजन सक्षम होता है।

मूल लेखक: Qing Ye, Jing Tan

प्रकाशित 2026-03-26
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Qing Ye, Jing Tan

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपने अपने लिए एक काम करने के लिए एक प्रतिभाशाली, अति-ऊर्जावान सहायक को काम पर रखा है। आप उन्हें एक कार्य देते हैं, और वे काम में जुट जाते हैं। लेकिन यहाँ एक पेंच है: आपने उन्हें कभी यह नहीं बताया कि उन्हें कब रुकना है, वे कितने पैसे खर्च कर सकते हैं, या "काम पूरा होने" का वास्तव में क्या मतलब है।

वास्तविक दुनिया में, यह सहायक आपको 11 दिनों तक लगातार काम करते हुए, आपके पूरे क्रेडिट कार्ड की सीमा को खत्म करते हुए, और अधिक पैसे मांगते हुए, "मुझे बस एक और चीज़ चेक करने की ज़रूरत है" के लूप में फंसे हुए देख सकता है। यह बिल्कुल वही हुआ जो 2025 के अंत में एक इंजीनियरिंग टीम के साथ हुआ, जिसके परिणामस्वरूप एक ऐसे AI सिस्टम का $47,000 का बिल आया जो बस रुकने का नाम ही नहीं ले रहा था।

यह पेपर एजेंट कॉन्ट्रैक्ट्स (Agent Contracts) नामक एक समाधान पेश करता है। इसे एक कानूनी और तकनीकी "नियम पुस्तिका" के रूप में समझें जो आप अपने AI को काम शुरू करने से पहले देते हैं। यह एक अनियंत्रित, अप्रत्याशित रोबोट को एक अनुशासित कर्मचारी में बदल देता है जिसे पता होता है कि उसे कितना खर्च करना है और उसे कब काम बंद करना है।

यहाँ सरल उपमाओं का उपयोग करके इसका विवरण दिया गया है:

1. मुख्य समस्या: "भागता हुआ रोबोट" (The Runaway Robot)

वर्तमान AI एजेंट असीमित क्रेडिट कार्ड की तरह हैं। आप उन्हें जितना चाहें उतना स्वाइप कर सकते हैं, लेकिन बिल अंत में आता है। यदि AI भ्रमित हो जाता है या किसी लूप में फंस जाता है, तो वह तब तक स्वाइप करता रहता है जब तक आपका बैंक खाता खाली न हो जाए। मौजूदा उपकरण AI को यह तो बता सकते हैं कि क्या करना है, लेकिन उनके पास औपचारिक रूप से यह कहने का तरीका नहीं है कि, "यदि आप $5 से अधिक खर्च करते हैं तो रुक जाएं" या "यदि आप 1 घंटे तक काम करते हैं तो रुक जाएं।"

2. समाधान: "एजेंट कॉन्ट्रैक्ट" (The Agent Contract)

लेखक एक औपचारिक दस्तावेज़ (डेटा का एक टुपल) प्रस्तावित करते हैं जो आपके और AI के बीच एक सख्त अनुबंध (Contract) की तरह कार्य करता है। इसके सात मुख्य भाग हैं, जिन्हें हम खेल के नियमों के रूपas देख सकते हैं:

  • कार्य विवरण (इनपुट/आउटपुट): "यह वह कच्चा माल है जो आपको मिलता है, और यह वह तैयार उत्पाद है जो आपको वापस करना है।"
  • टूलकिट (कौशल): "आपको कैलकुलेटर और वेब ब्राउज़र का उपयोग करने की अनुमति है, लेकिन आपको अपने स्वयं के बैंक खाते तक पहुँचने की अनुमति नहीं है।"
  • वॉलेट (संसाधन बाधाएं): यह सबसे महत्वपूर्ण हिस्सा है। यह कहता है: "आपके पास खर्च करने के लिए $5.00 हैं। आपके पास सोचने के लिए 100,000 शब्द हैं। आप केवल 10 वेब खोजें कर सकते हैं।"
  • स्टॉपवॉच (समय सीमा): "आपके पास खत्म करने के लिए 30 मिनट हैं। यदि घड़ी 30:01 पर पहुँचती है, तो आपको तुरंत रुकना होगा।"
  • लक्ष्य पोस्ट (सफलता का मानदंड): "आप जीतते हैं यदि आप 90% सटीकता के साथ उत्तर ढूंढ लेते हैं। यदि नहीं, तो आप हार जाते हैं।"
  • "किल स्विच" (समाप्ति): "यदि आपके पास पैसा खत्म हो जाता है, समय समाप्त हो जाता है, या आप फंस जाते हैं, तो अनुबंध स्वतः समाप्त हो जाता है।"

3. "पारिवारिक बजट" (मल्टी-एजेंट समन्वय)

क्या होगा यदि आपको AI की एक टीम की आवश्यकता है? एक रिसर्च करने के लिए, एक लिखने के लिए, और एक एडिट करने के लिए?
बिना कॉन्ट्रैक्ट के, "रिसर्चर" सारा पैसा खर्च कर सकता है, जिससे "राइटर" के लिए कुछ नहीं बचेगा।
पेपर संरक्षण नियमों (Conservation Laws) को पेश करता है। इसे एक पारिवारिक बजट के रूप में सोचें:

  • माता-पिता परिवार को $100 देते हैं।
  • माता-पिता रिसर्चर को 40औरराइटरको40** और राइटर को **40 देते हैं, और $20 सुरक्षा बफर के रूप में रखते हैं।
  • भले ही रिसर्चर 50खर्चकरनेकीकोशिशकरे,सिस्टमउन्हेंरोकदेताहैक्योंकिकॉन्ट्रैक्टकहताहै,"आपकेपासकेवल50 खर्च करने की कोशिश करे, सिस्टम **उन्हें रोक देता है** क्योंकि कॉन्ट्रैक्ट कहता है, "आपके पास केवल 40 हैं।"
  • यदि रिसर्चर जल्दी समाप्त कर देता है और केवल 30खर्चकरताहै,तोवहअतिरिक्त30 खर्च करता है, तो वह अतिरिक्त 10 वापस पारिवारिक पॉट में चला जाता है जिसे राइटर उपयोग कर सकता है।

यह सुनिश्चित करता है कि पूरी टीम मूल बजट से अधिक खर्च न करे, चाहे वे कितने भी सब-टीम्स क्यों न बना लें।

4. वास्तविक जीवन में यह कैसे काम करता है (प्रयोग)

लेखकों ने चार अलग-अलग परिदृश्यों के साथ इसका परीक्षण किया, और परिणाम जादू की तरह थे:

  • "कोड रिव्यू" टेस्ट: उन्होंने AI को कोड ठीक करने दिया। बिना कॉन्ट्रैक्ट के, वह पागल हो गया और बहुत पैसा खर्च किया। कॉन्ट्रैक्ट के साथ, उसने 90% कम पैसा खर्च किया और कोड को ठीक करने में उतना ही अच्छा रहा। उसने उन चीजों को ठीक करने की कोशिश करना बंद कर दिया जो पहले से ही परफेक्ट थीं।
  • "रिसर्च टीम" टेस्ट: उन्होंने तीन AI को मिलकर काम करने के लिए कहा। बिना कॉन्ट्रैक्ट के, एक एजेंट कभी-कभी अनियंत्रित होकर पैसा बर्बाद कर देता था। कॉन्ट्रैक्ट के साथ, शून्य एजेंटों ने कभी भी बजट नियमों को तोड़ा।
  • "गति बनाम गुणवत्ता" टेस्ट: उन्होंने दिखाया कि आप AI को बता सकते हैं, "मुझे यह जल्दी चाहिए, भले ही यह थोड़ा कम परफेक्ट हो" (अर्जेंट मोड) या "मुझे यह परफेक्ट चाहिए, अपना समय लें" (बैलेंस्ड मोड)। AI ने ठीक वैसे ही व्यवहार किया जैसा अनुरोध किया गया था।

5. पकड़ (द "पोस्ट-कॉल" प्रॉब्लम)

एक छोटी सी सीमा है। AI को यह ठीक से पता नहीं चलता कि वह सोचते समय कितना खर्च कर रहा है। उसे वाक्य समाप्त करने के बाद ही लागत का पता चलता है।

  • उपमा: यह पिज्जा ऑर्डर करने जैसा है। आपको डिलीवरी मैन के रसीद देने तक सटीक कीमत का पता नहीं चलता।
  • समाधान: सिस्टम वर्तमान पिज्जा ऑर्डर को नहीं रोक सकता यदि वह बहुत महंगा है, लेकिन यह तुरंत अगला ऑर्डर रद्द कर सकता है। यह उस "रनवे" परिदृश्य को रोकता है जहाँ AI 11 दिनों तक पिज्जा ऑर्डर करता रहता है।

यह क्यों मायने रखता है

यह केवल पैसा बचाने के बारे में नहीं है। यह सुरक्षा और विश्वास के बारे में है।

  • अनुमान लगाने की क्षमता (Predictability): आप शुरू करने से पहले जानते हैं कि एक AI कार्य की लागत कितनी होगी।
  • जवाबदेही (Accountability): यदि कोई AI विफल होता है, तो आप जानते हैं कि क्यों (उसका समय समाप्त हो गया, या वह गुणवत्ता सीमा तक पहुँच गया)।
  • स्केलेबिलिटी (Scalability): अब आप बिना इस चिंता के AI एजेंटों की बड़ी टीमें बना सकते हैं कि उनमें से एक गलती से आपकी कंपनी को दिवालिया कर देगा।

संक्षेप में: एजेंट कॉन्ट्रैक्ट्स AI को एक "वाइल्ड कार्ड" से बदलकर एक "विश्वसनीय कर्मचारी" में बदल देते हैं जो सख्त नियम पुस्तिका का पालन करता है, बजट का सम्मान करता है, और समय पर काम खत्म करता है। यह एक ऐसे जीनियस को काम पर रखने और एक पेशेवर को काम पर रखने के बीच का अंतर है जो घर जला सकता है बनाम वह जो सुरक्षित रूप से काम पूरा करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →