← नवीनतम पेपर
💻 computer science

KAIJU: An Executive Kernel for Intent-Gated Execution of LLM Agents

KAIJU एक सिस्टम-लेवल फ्रेमवर्क पेश करता है जो एक एक्जीक्यूटिव कर्नल और इंटेंट-गेटेड एक्जीक्यूशन (IGX) प्रतिमान के माध्यम से LLM रीजनिंग को निष्पादन (execution) से अलग करता है, जो पारंपरिक ReAct एजेंटों की तुलना में समानांतर टूल शेड्यूलिंग, मल्टी-वेरिएबल ऑथोराइजेशन के माध्यम से उन्नत सुरक्षा, और जटिल, डेटा-गहन कार्यों पर बेहतर प्रदर्शन सक्षम करता है।

मूल लेखक: Cormac Guerin, Frank Guerin

प्रकाशित 2026-04-07
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Cormac Guerin, Frank Guerin

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक उच्च-दांव वाले अनुसंधान संस्थान (high-stakes research firm) के सीईओ हैं। आपके पास एक प्रतिभाशाली, तेज़ बोलने वाला इंटर्न (LLM) है जो अविश्वसनीय रूप से स्मार्ट है लेकिन दिवास्वप्न देखने, बहुत अधिक कागजी कार्रवाई से घबरा जाने और कभी-कभी किसी कमांड को गलत समझकर गलती से ऑफिस में धमाका करने की कोशिश करने का आदी है।

आपका काम करने का पुराना तरीका (जिसे React कहा जाता है) ऐसा है: आप इंटर्न को एक कार्य देते हैं। वे सोचते हैं, एक काम करते हैं, एक रिपोर्ट लिखते हैं, उसे आपको दिखाते हैं, आपकी प्रतिक्रिया का इंतज़ार करते हैं, फिर फिर से सोचते हैं, अगला काम करते हैं, एक लंबी रिपोर्ट लिखते हैं, आपको दिखाते हैं, और इसी तरह आगे बढ़ते हैं।

पुराने तरीके के साथ समस्याएँ:

  1. "नोटबुक" बहुत भारी हो जाती है: हर बार जब इंटर्न आपको एक रिपोर्ट दिखाता है, तो उन्हें इस प्रोजेक्ट में किए गए अब तक के सभी कामों का पूरा इतिहास साथ लेकर चलना पड़ता है। 10 चरणों के बाद, नोटबुक इतनी मोटी (बहुत अधिक "टोकन") हो जाती है कि इंटर्न उसे पढ़ नहीं पाता, भ्रमित हो जाता है और बेतुकी बातें (hallucinations) करने लगता है।
  2. "हार मान लेने" वाला कारक: यदि इंटर्न एक प्लंबर को कॉल करने की कोशिश करता है और लाइन व्यस्त आती है, तो वे बस यह सोचकर हार मान सकते हैं, "छोड़ो, मैं बस अंदाज़ा लगा लेता हूँ," या मदद के लिए तुरंत आपसे पूछ सकते हैं, बजाय इसके कि वे किसी दूसरे प्लंबर को आज़माएँ।
  3. "सुरक्षा" की खामी: आप इंटर्न को कहते हैं, "लाल बटन को मत छूना।" लेकिन अगर वे भ्रमित हो जाते हैं या किसी अजीब प्रॉम्प्ट से धोखा खा जाते हैं, तो वे बटन दबा सकते हैं। यहाँ बटन पर कोई भौतिक ताला नहीं है; केवल एक मौखिक चेतावनी है।

प्रवेश होता है KAIJU: द एग्जीक्यूटिव कर्नल (The Executive Kernel)
लेखकों ने इस पेपर में KAIJU नामक एक नया सिस्टम बनाया है। KAIJU को एक अत्यधिक कुशल, स्वचालित फैक्ट्री फ्लोर के रूप में समझें जो आपके (उपयोगकर्ता) और इंटर्न के बीच स्थित है।

KAIJU कैसे काम करता है, इसके सरल उदाहरण यहाँ दिए गए हैं:

1. आर्किटेक्ट बनाम निर्माण दल (शक्तियों का पृथक्करण)

पुराने तरीके में, इंटर्न ही आर्किटेक्ट, फोरमैन और राजमिस्त्री तीनों था।
KAIJU में, आपके पास दो अलग-अलग भूमिकाएँ हैं:

  • द प्लानर (आर्किटेक्ट): इंटर्न एक शांत कमरे में बैठता है। आप उन्हें ब्लूप्रिंट देते हैं। वे काम का एक पूरा नक्शा (एक "डिपेंडेंसी ग्राफ") तैयार करते हैं इससे पहले कि कोई हथौड़ा उठाए। वे काम नहीं करते; वे केवल योजना बनाते हैं।
  • द एग्जीक्यूटिव कर्नल (फैक्ट्री मैनेजर): यह KAIJU सिस्टम है। यह आर्किटेक्ट के नक्शे को लेता है और उसे निर्माण दल को भेज देता है। दल लहरों (waves) में काम करता है। वे हर ईंट की जाँच के लिए आर्किटेक्ट के वापस आने का इंतज़ार नहीं करते। वे बस नक्शे का पालन करते हैं।

2. "इंटेंट-गेटेड" सुरक्षा चेकपॉइंट (IGX)

यह सबसे शानदार हिस्सा है। कल्पना कीजिए कि एक उच्च-सुरक्षा वाला हवाई अड्डा है।

  • पुराना तरीका: इंटर्न को कहा जाता है, "खतरनाक देशों में न उड़ें।" लेकिन अगर उन्हें चकमा दिया गया, तो वे उड़ ही जाएंगे।
  • KAI-JU तरीका: इंटरल उड़ान की योजना बनाता है। लेकिन विमान के उड़ान भरने से पहले, वह एक सुरक्षा द्वार (Security Gate) से टकराता है।
    • स्कोप (Scope): क्या इस विमान को उड़ने की अनुमति है?
    • इरादा (Intent): क्या सीईओ (आप) ने इस विशिष्ट यात्रा को अधिकृत किया है?
    • प्रभाव (Impact): क्या यह एक यात्री उड़ान (सुरक्षित) है या बम गिराने वाला मिशन (खतरनाक)?
    • क्लियरेंस (Clearance): क्या गंतव्य देश के पास हमारे लिए वास्तव में वीज़ा है?

यह द्वार एक रोबोट है। यह इन चार चीजों की जाँच करता है। यदि उत्तर "नहीं" है, तो विमान को ग्राउंड कर दिया जाता है। महत्वपूर्ण बात यह है कि इंटर्न इस द्वार को नहीं देख पाता। उन्हें बस "उड़ान विफल" (Flight Failed) दिखता है। वे द्वार को धोखा नहीं दे सकते क्योंकि वे उस कमरे में मौजूद ही नहीं हैं।

3. "वेव" सिस्टम (समानांतर निष्पादन)

इंटर्न द्वारा एक समय में एक काम करने और आपके द्वारा "अच्छा काम किया, अब अगला काम करो" कहने का इंतज़ार करने के बजाय, KAIJU श्रमिकों की लहरें (waves) भेजता है।

  • वेव 1: 5 श्रमिकों को मौसम की जाँच करने, बैंक को कॉल करने, ट्रैफ़िक की जाँच करने और दोपहर का भोजन ऑर्डर करने के लिए भेजें। वे सभी एक ही समय में जाते हैं।
  • वेव 2: एक बार जब मौसम की रिपोर्ट आ जाती है, तो एक "रिफ्लेक्टर" (एक स्मार्ट सुपरवाइजर) उस पर नज़र डालता है। यदि मौसम खराब है, तो सुपरवाइजर तुरंत अगली लहर के लिए योजना बदल देता है, बिना आपसे पूछे।

क्योंकि वे समानांतर (parallel) में काम करते हैं, इसलिए बड़े और जटिल कार्यों के लिए काम बहुत तेज़ी से पूरा हो जाता है।

4. "बाउंडेड कॉन्टेक्स्ट" (कोई भारी नोटबुक नहीं)

पुराने तरीके में, इंटर्न एक नोटबुक साथ रखता था जो हर चरण के साथ बड़ी होती जाती थी।
KAIJU में, फैक्ट्री मैनेजर बड़ा नोटबुक रखता है। इंटर्न (प्लानर) केवल इस लहर के विशिष्ट कार्य को देखता है।

  • वेव 1: इंटर्न देखता है "मौसम की जाँच करें।"
  • वेव 2: इंटर्न देखता है "ट्रैफ़िक की जाँच करें।"
    उन्हें कभी भी पूरा इतिहास पढ़ने की आवश्यकता नहीं होती। इससे उन्हें अभिभूत होने और गलतियाँ करने से रोका जाता है।

5. जब चीजें गलत होती हैं तो क्या होता है?

  • पुराना तरीका: यदि कोई टूल विफल हो जाता है, तो इंटर्न घबरा जाता है, रुक जाता है और आपसे पूछता है, "मुझे क्या करना चाहिए?" या बस अंदाज़ा लगाने लगता है।
  • KAIJU तरीका: यदि कोई श्रमिक ईंट गिरा देता है, तो एक माइक्रो-प्लानर (एक विशेष रोबोट) तुरंत एक अलग टूल या अलग कोण आज़माता है। यह तब तक प्रयास करता रहता है जब तक कि काम पूरा न हो जाए। यह आपसे अनुमति नहीं मांगता; यह बस समस्या को ठीक करता है और आगे बढ़ता रहता है।

परिणाम: यह क्यों मायने रखता है?

पेपर ने कठिन कार्यों (जैसे ग्रहों की स्थिति की गणना करना या जटिल डेटा खोजना) पर पुराने तरीके के मुकाबले KAIJU का परीक्षण किया।

  • सरल कार्य: पुराना तरीका थोड़ा तेज़ था (क्योंकि KAIJU को पहले नक्शा बनाना पड़ता है)।
  • जटिल कार्य: KAIJU 2x से 3x तेज़ और बहुत अधिक विश्वसनीय था।
  • सुरक्षा: KAIJU ने कभी भी किसी "खतरनाक" कमांड को फिसलने नहीं दिया, जबकि पुराने तरीके में कभी-कभी ऐसी चूक हो जाती थी।
  • गुणवत्ता: जब चीजें कठिन हुईं तो KAIJU ने हार नहीं मानी। यह उत्तर खोजने के लिए खुदाई करता रहा, जबकि पुराना तरीका अक्सर हार मान लेता था और अंदाज़ा लगा लेता था।

संक्षेप में:
KAIJU एक अराजक, बातचीत वाले संवाद को एक सैन्य-ग्रेड ऑपरेशन में बदल देता है। यह "सोचने" को "करने" से अलग करता है, दरवाजे पर एक रोबोटिक सुरक्षा गार्ड रखता है, और यह सुनिश्चित करता है कि भले ही योजना गलत हो जाए, सिस्टम बिना मानव बॉस को परेशान किए खुद को ठीक कर ले। यह AI एजेंटों को गंभीर काम के लिए सुरक्षित, तेज़ और अधिक विश्वसनीय बनाता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →