← नवीनतम पेपर
💻 computer science

Agentproof: Static Verification of Agent Workflow Graphs

एजेंटप्रूफ (Agentproof) एक स्टैटिक वेरिफिकेशन सिस्टम है जो संरचनात्मक दोषों का पता लगाने और एक विशेष DSL एवं DFA-आधारित विश्लेषण के माध्यम से टेम्पोरल सेफ्टी पॉलिसीज़ को लागू करने के लिए प्रमुख एजेंट फ्रेमवर्क्स से स्वचालित रूप से यूनिफाइड ग्राफ मॉडल निकालता है, जो तैनाती से पहले टोपोलॉजी-स्तर की समस्याओं की पहचान करके रनटाइम गार्डरेल्स का पूरक बनता है।

मूल लेखक: Melwin Xavier, Vaisakh M A, Melveena Jolly, Midhun Xavier

प्रकाशित 2026-03-24
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Melwin Xavier, Vaisakh M A, Melveena Jolly, Midhun Xavier

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक जटिल रोबोट बटलर (नौकर) बना रहे हैं। आप उसे सिर्फ यह नहीं कहते कि "घर साफ करो"; बल्कि आप एक विस्तृत फ्लोचार्ट लिखते हैं: झाड़ू उठाओ → किचन में जाओ → यदि फर्श गंदा है, तो झाड़ू लगाओ → यदि फर्श साफ है, तो लिविंग रूम में जाओ → झाड़ू वापस रख दो।

AI की दुनिया में, इन "रोबोट्स" को एजेंट्स (Agents) कहा जाता है। वे वर्कफ़्लो ग्राफ़ (Workflow Graphs) नामक इन फ्लोचार्ट्स का उपयोग करके टूल्स (जैसे वेब सर्च करना या ईमेल भेजना) का उपयोग करते हैं।

समस्या यह है कि जब डेवलपर्स ये फ्लोचार्ट बनाते हैं, तो वे अक्सर मूर्खतापूर्ण गलतियाँ करते हैं। वे शायद एक ऐसा रास्ता बना देते हैं जो डेड एंड (बंद रास्ते) की ओर ले जाता है (रोबोट फंस जाता है), या वे डेटाबेस डिलीट करने से पहले एक "ह्यूमन अप्रूवल" (मानवीय स्वीकृति) का स्टेप लगाना भूल जाते हैं।

वर्तमान में, हम इन गलतियों की जाँच केवल रोबोट के चलते समय करते हैं। यदि रोबोट फंस जाता है, तो हमें केवल तभी पता चलता है जब वह वास्तव में उस विशिष्ट पथ पर चलने की कोशिश करता है। यह वैसा ही है जैसे कार के क्रैश होने का इंतज़ार करना, इससे पहले कि आपको पता चले कि ब्रेक कभी जुड़े ही नहीं थे।

Agentproof एक नया टूल है जो एक सुपर-स्मार्ट आर्किटेक्ट की तरह काम करता है जो घर बनाने से पहले ही उसके ब्लूप्रिंट (नक्शे) की जाँच करता है।

यह कैसे काम करता है, यहाँ सरल उपमाओं (analogies) का उपयोग किया गया है:

1. यूनिवर्सल ट्रांसलेटर (द एक्सट्रैक्टर - The Extractor)

अलग-अलग रोबोट निर्माता अलग-अलग भाषाओं का उपयोग करते हैं। कोई "LangGraph" का उपयोग करता है, कोई "CrewAI" का, या "AutoGen" का। यह वैसा ही है जैसे एक बिल्डर फ्रेंच बोलता है, दूसरा जापानी, और तीसरा जर्मन।

  • Agentproof का काम: इसके पास उन सभी के लिए एक ट्रांसलेटर है। यह किसी भी भाषा में ब्लूप्रिंट को पढ़ता है और उसे तुरंत एक एकल, मानक "यूनिवर्सल ब्लूप्रिंट" में बदल देता है जिसे यह समझ सके। आपको अपना कोड फिर से लिखने की आवश्यकता नहीं है; Agentproof बस इसे पढ़ लेता है।

2. "स्पॉट द ग्लिच" इंस्पेक्टर (स्ट्रक्चरल चेक्स - Structural Checks)

एक बार जब इसके पास यूनिवर्सल ब्लूप्रिंट आ जाता है, तो Agentproof तार्किक त्रुटियों (logical errors) को खोजने के लिए छह त्वरित जाँच करता है। इसे "वेयर्स वाल्डो" (Where's Waldo) के खेल की तरह समझें:

  • द डेड एंड (The Dead End): "हे, यह रास्ता एक दीवार की ओर ले जाता है। रोबोट यहाँ हमेशा के लिए फंस जाएगा।"
  • द घोस्ट एग्जिट (The Ghost Exit): "आपके पास एक 'एंड' (समाप्त) बटन है, लेकिन वहां जाने वाला कोई रास्ता नहीं है। रोबोट कभी नहीं जान पाएगा कि कब रुकना है।"
  • द मिसिंग गेट (The Missing Gate): "आप रोबोट को फाइल डिलीट करने देने वाले हैं, लेकिन आप इसके सामने एक 'ह्यूमन अप्रूवल' चेकपॉइंट लगाना भूल गए हैं!"
  • द मैजिक ट्रिक (The Magic Trick): यदि इसे कोई गलती मिलती है, तो यह केवल "Error" नहीं कहता। यह आपको एक विटनेस ट्रेस (Witness Trace) देता है। यह एक GPS रूट की तरह है जो आपको ठीक से दिखाता है: शुरू करें → बाएँ मुड़ें → सीधा जाएँ → क्रैश। यह ठीक वही रास्ता दिखाता है जिससे रोबक फंसने वाला है।

3. द रूलबुक एनफोर्सर (टेम्पोरल पॉलिसीज़ - Temporal Policies)

कभी-कभी समस्या डेड एंड की नहीं होती, बल्कि चीजों के क्रम (order) की होती है।

  • नियम: "आपको बैकअप लेने से पहले कभी भी टेबल डिलीट नहीं करना चाहिए।"
  • नियम: "यदि आप ईमेल भेजते हैं, तो पहले एक इंसान को इसकी समीक्षा करनी चाहिए।"

Agentproof इन नियमों को एक सरल "ट्रैफिक लाइट" सिस्टम (जिसे DFA कहा जाता है) में बदल देता है। यह ब्लूप्रिंट की जाँच करता है कि क्या रोबोट द्वारा लिया जाने वाला कोई भी संभावित पथ इन नियमों को तोड़ता है।

  • स्टैटिक चेक (Static Check): यह उस ब्लूप्रिंट पर रोबोट द्वारा की जाने वाली हर संभावित यात्रा का अनुकरण (simulate) करता है। यदि कोई भी पथ नियम तोड़ता है, तो यह आपको तैनात (deploy) करने से पहले ही रोक देता है।
  • रनटाइम चेक (Runtime Check): यह रोबोट को काम करते समय भी देख सकता है, एक सुरक्षा गार्ड की तरह जो कुछ भी बुरा करने की कोशिश करने पर "रुको!" चिल्लाकर आपको सचेत कर देता है।

यह एक बड़ी बात क्यों है?

  • कोई मैनुअल काम नहीं: पुराने टूल्स के लिए आपको अपने रोबोट के कोड को एक विशेष "वेरिफिकेशन लैंग्वेज" में फिर से लिखना पड़ता था (जैसे किसी उपन्यास को गणित के समीकरण में बदलना)। Agentproof यह स्वचालित रूप से करता है।
  • गति: यह एक सेकंड से भी कम समय में विशाल ब्लूप्रिंट (5,000 स्टेप्स तक) की जाँच कर लेता है।
  • सुरक्षा: 18 अलग-अलग रोबोट ब्लूप्रिंट के एक परीक्षण में, Agentproof ने पाया कि 27% में स्ट्रक्चरल ग्लिच (डेड एंड) थे और 55% में ह्यूमन सेफ्टी गेट्स गायब थे। ये ऐसी गलतियाँ थीं जिन्हें केवल रोबोट का कुछ बार परीक्षण करके पकड़ना बहुत कठिन होता।

निचोड़ (The Bottom Line)

Agentproof को AI रोबोट के लिए सेफ्टी इंस्पेक्टर के रूप में देखें।

  • रनटाइम गार्डरेल्स (Runtime Guardrails) (पुराना तरीका) सीटबेल्ट की तरह हैं: वे आपको तब पकड़ते हैं जब आप दुर्घटनाग्रस्त हो जाते हैं, लेकिन वे दुर्घटना को होने से नहीं रोकते।
  • Agentproof कार चलाने से पहले उसके इंजन और ब्रेक की जाँच करने जैसा है। यह सुनिश्चित करता है कि आपने रोबोट को जो मैप दिया है वह वास्तव में एक मंजिल की ओर ले जाता है और उसमें सड़क के कोई गड्ढे नहीं हैं।

यह यह जाँच नहीं करता कि रोबोट कितना "स्मार्ट" है या वह सच बोल रहा है या नहीं (वह एक अलग समस्या है); यह बस यह सुनिश्चित करता है कि रोबोट की योजना (plan) तार्किक रूप से सही है और निष्पादित करने के लिए सुरक्षित है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →