← नवीनतम पेपर
🤖 AI

paper.json: A Coordination Convention for LLM-Agent-Actionable Papers

यह शोध पत्र `paper.json` का प्रस्ताव करता है, जो अकादमिक शोध पत्रों के लिए एक हल्का साथी JSON कन्वेंशन है, जो स्थिर आईडी (stable IDs) और स्पष्ट शेल कमांड्स (explicit shell commands) का उपयोग करता है ताकि LLM एजेंट मूल मानव-पठनीय पाठ को बदले बिना विश्वसनीय रूप से उप-दावों (sub-claims) को निकाल सकें, दायरे को परिभाषित कर सकें और परिणामों को पुनरुत्पादित कर सकें।

मूल लेखक: Arquimedes Canedo

प्रकाशित 2026-05-18
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Arquimedes Canedo

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक रोबोट को वैज्ञानिक शोध पत्र (scientific paper) पढ़ना सिखाने की कोशिश कर रहे हैं। आप उसे एक मानक PDF देते हैं, यह उम्मीद करते हुए कि वह मुख्य बिंदुओं को समझ लेगा, विशिष्ट प्रयोगों को खोज लेगा, और शायद यह देखने के लिए कोड भी चला लेगा कि परिणाम वास्तविक हैं या नहीं।

समस्या यह है, जैसा कि यह पेपर बताता है, कि मानक शोध पत्र इंसानों के लिए लिखे जाते हैं, रोबोट के लिए नहीं। वे एक स्वादिष्ट, जटिल कहानी की तरह हैं जहाँ सबसे महत्वपूर्ण तथ्य फूलों वाली भाषा वाले पैराग्राफों में दबे होते हैं। जब एक रोबोट इसे पढ़ने की कोशिश करता है, तो वह भ्रमित हो जाता है। वह किसी ऐसे तथ्य का अनुमान लगा सकता है जो वहाँ मौजूद ही नहीं है, वह किसी प्रयोग को चलाने के लिए आवश्यक विशिष्ट कमांड को मिस कर सकता है, या किसी परिभाषा को गलत समझ सकता है।

यह पेपर एक सरल समाधान प्रस्तावित करता है: paper.json

paper.json को एक मशीन-पठनीय "चीट शीट" (cheat sheet) के रूप में समझें जो पेपर के साथ ही एक ही लिफाफे में आती है। यह इस बात को नहीं बदलता कि पेपर इंसान को कैसा दिखता है; यह बस एक संरचित, डिजिटल परत जोड़ देता है जिसे रोबट तुरंत समझ सकते हैं।

यहाँ यह पेपर चार मुख्य "नियमों" (परंपराओं) का उपयोग करके समाधान को समझाता है, जिन्हें रोजमर्रा के उदाहरणों के साथ समझाया गया है:

1. "स्टिकी नोट" सिस्टम (स्थिर क्लेम आईडी - Stable Claim IDs)

समस्या: एक सामान्य पेपर में, यदि कोई रोबोट किसी विशिष्ट वाक्य को उद्धृत (quote) करना चाहता है, तो उसे पूरे टेक्स्ट में खोजना पड़ता है। वह गलत वाक्य पकड़ सकता है या बारीकियों को मिस कर सकता है।
समाधान: पेपर हर महत्वपूर्ण दावे (claim) को एक अद्वितीय ID प्रदान करता है, जैसे कि नंबर वाला एक स्टिकी नोट (उदाहरण के लिए, C1, C2)।
उदाहरण: कल्पना कीजिए कि एक लाइब्रेरी है जहाँ हर किताब की एक विशिष्ट शेल्फ लोकेशन है। रोबोट को यह बताने के बजाय कि "जाओ और तीसरे अध्याय में नीली चिड़िया के बारे में हिस्सा ढूँढो," आप बस कहते हैं, "जाओ C1 पर।" रोबोट को ठीक से पता होता है कि कहाँ देखना है, अनुमान लगाने की कोई आवश्यकता नहीं है।

2. "हमने क्या नहीं किया" की सूची (स्पष्ट गैर-दावे - Explicit Non-Claims)

समस्या: रोबोट अक्सर बहुत उत्साहित हो जाते हैं। यदि कोई पेपर कहता है "मेथड A, डेटासेट X पर काम करता है," तो एक रोबोट अनुमान लगा सकता है, "ओह, तो मेथड A हर चीज़ पर काम करता है!" इसे "स्कोप ओवरएक्सटेंशन" (scope overextension) कहा जाता है।
समाधान: पेपर में एक विशिष्ट अनुभाग शामिल है जिसे "Does-Not-Claim" कहा जाता है।
उदाहरण: एक रेस्टोरेंट के मेनू के बारे में सोचें। आमतौर पर, मेनू में वह सूचीबद्ध होता है जो आप ऑर्डर कर सकते हैं। यह पेपर उस सूची को भी जोड़ता है जो आप नहीं ऑर्डर कर सकते। यह स्पष्ट रूप से रोबोट को बताता है: "हमने इसे सेबों पर टेस्ट किया है, लेकिन हमने इसे संतरों पर नहीं टेस्ट किया है। यह न मानें कि यह संतरों पर भी काम करता है।" यह रोबोट को तथ्य बनाने से रोकता है।

3. "कॉपी-पेस्ट" बटन (एक्सेक्यूटेबल कमांड्स - Executable Commands)

समस्या: एक पेपर कह सकता है, "हमने फिगर 3 बनाने के लिए एक स्क्रिप्ट चलाई।" लेकिन यह नहीं बताता कि कौन सी स्क्रिप्ट, या किन सेटिंग्स का उपयोग करना है। रोबोट को अनुमान लगाना पड़ता है, और वह आमतौर पर गलत अनुमान लगाता है।
समाधान: पेपर उस सटीक कमांड को सूचीबद्ध करता है जिसे रोबोट को चित्र (figure) को फिर से बनाने के लिए कंप्यूटर में टाइप करने की आवश्यकता है।
उदाहरण: कल्पना कीजिए कि एक रेसिपी कहती है, "पास्ता को तब तक पकाएं जब तक वह पक न जाए।" यह अस्पष्ट है। paper.json उस रेसिपी की तरह है जो कहती है: "ठीक से टाइप करें: boil water -time 10min।" रोबोट उस स्ट्रिंग को कॉपी कर सकता है, पेस्ट कर सकता है, और बिना शेफ बने उसे चला सकता है।

4. "डिक्शनरी" (स्थिर परिभाषाएँ - Stable Definitions)

समस्या: वैज्ञानिक अक्सर शब्दों का उपयोग विशिष्ट तरीकों से करते हैं जो रोज़मर्रा की भाषा से अलग होते हैं। यदि कोई पेपर एक लंबे पैराग्राफ में किसी शब्द को परिभाषित करता है, तो रोबोट उसे मिस कर सकता है और बाद में गलत अर्थ का उपयोग कर सकता है।
समाधान: पेपर प्रत्येक परिभाषा को एक अद्वितीय ID (जैसे D1) देता है और उसे स्पष्ट रूप से लिखता है।
उदाहरण: यह एक शब्दावली (glossary) होने जैसा है जहाँ प्रत्येक शब्द का एक निश्चित ID कार्ड होता है। यदि रोबोट "नेटवर्क" शब्द देखता है, तो उसे यह अनुमान लगाने की ज़रूरत नहीं है कि आपका मतलब कंप्यूटर नेटवर्क से है या सोशल नेटवर्क से। वह बस D1 को देखता है और लेखक द्वारा लिखी गई सटीक परिभाषा देख लेता है।

"C4" नियम: इसे सरल रखें

पेपर इस बात पर जोर देता है कि यह मानव लेखकों के लिए कठिन नहीं होना चाहिए।
उदाहरण: आपको डोरबेल जोड़ने के लिए अपने घर को फिर से बनाने की ज़रूरत नहीं है। आपको बस बटन इंस्टॉल करना है। लेखक दावा करते हैं कि इस "चीट शीट" (paper.json) को हाथ से लिखने में एक घंटे से भी कम समय लगता है और इसके लिए किसी विशेष सॉफ़्टवेयर या पेपर के टेक्स्ट को बदलने की आवश्यकता नहीं है। यह एक कम लागत वाला जोड़ है जो पेपर को "रोबोट-रेडी" बनाता है।

प्रयोग

यह पेपर अद्वितीय है क्योंकि यह जो कहता है, वही करता है

  • इस पेपर का अपना एक paper.json फ़ाइल है।
  • इसमें एक "वैलिडेटर" (एक टूल जो यह जाँचता है कि चीट शीट पेपर से मेल खाती है या नहीं) शामिल है।
  • यह रोबोटों को इसे पढ़ने, इन नियमों का परीक्षण करने और यह रिपोर्ट करने के लिए आमंत्रित करता है कि वे काम कर रहे हैं या विफल हो रहे हैं।

यह पेपर क्या दावा नहीं करता है

लेखक बहुत सावधान हैं कि वे बहुत बड़े वादे न करें। वे स्पष्ट रूप से कहते हैं:

  • उन्होंने यह साबित नहीं किया है कि रोबोट अब कभी गलती नहीं करेंगे; उन्होंने बस इसे कम संभव बनाया है।
  • उन्होंने अभी तक हर प्रकार के पेपर (जैसे जटिल गणितीय प्रमेय वाले पेपर) के लिए इस समस्या को हल नहीं किया है; यह भविष्य का कार्य है।
  • वे मौजूदा सिस्टम (जैसे मानक अकादमिक डेटाबेस) को बदल नहीं रहे हैं; वे बस उसके ऊपर एक हल्का लेयर जोड़ रहे हैं।

संक्षेप में: यह पेपर सुझाव देता है कि रोबोटों को विज्ञान पढ़ने में मदद करने के लिए, हमें केवल इंसानों के लिए लिखना बंद करना होगा। एक सरल, संरचित "चीट शीट" (paper.json) जोड़कर, जो यह सूचीबद्ध करती है कि पेपर क्या दावा करता है, क्या नहीं करता है, और कोड को कैसे चलाना है, हम रोबोटों को अनुमान लगाने से रोक सकते हैं और उन्हें जानने की ओर ले जा सकते हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →