FormalScience: Scalable Human-in-the-Loop Autoformalisation of Science with Agentic Code Generation in Lean
यह शोध पत्र **FormalScience** को प्रस्तुत करता है, जो एक मानव-इन-द-लूप एजेंटिक पाइपलाइन है जिसे डोमेन विशेषज्ञों को वैज्ञानिक तर्क को Lean4 कोड में कुशलतापूर्वक ऑटोफॉर्मलाइज़ करने में मदद करने के लिए डिज़ाइन किया गया है, जिसे विश्वविद्यालय स्तर की भौतिकी की समस्याओं के एक उच्च-गुणवत्ता वाले डेटासेट, **FormalPhysics** के निर्माण के माध्यम से प्रदर्शित किया गया है जो LLM-आधारित फॉर्मलाइज़ेशन में सिमेंटिक ड्रिफ्ट (semantic drift) का एक व्यवस्थित विश्लेषण प्रदान करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक विश्व स्तरीय शेफ हैं जो अपनी सुंदर, बहती हुई, हस्तलिखित डायरी में रेसिपी लिखते हैं। आपकी रेसिपी अंतर्ज्ञान से भरी होती है: "एक चुटकी नमक तब तक डालें जब तक कि यह सही न लगने लगे," या "प्याज को तब तक भूनें जब तक वे सुनहरे और स्वप्निल (dreamy) न दिखने लगें।" यह ऐसे तरीके से है जिससे वैज्ञानिक लिखते हैं—अनौपचारिक तर्क (informal reasoning) (LaTeX) का उपयोग करते हुए जो अर्थ से तो समृद्ध है लेकिन कंप्यूटर के लिए "धुंधला" है।
अब, कल्पना कीजिए कि आप ये रेसिपी एक हाई-टेक, रोबोटिक रसोई को देना चाहते हैं। रोबोट "स्वप्निल" या "एक चुटकी" को नहीं समझता। वह केवल औपचारिक कोड (जैसे Lean4) समझता है—एक सख्त, गणितीय भाषा जहाँ हर एक परमाणु का हिसाब होना चाहिए। यदि आप एक कॉमा भी भूल जाते हैं, तो रोबकी क्रैश हो जाता है।
समस्या क्या है? "स्वप्निल प्याज" को "बिल्कुल 4.2 ग्राम प्याज 175°C पर" में अनुवाद करना अविश्वसनीय रूप से कठिन है। यह शोध पत्र, FormalScience, "स्वप्निल शेफ" (वैज्ञानिक) और "रोबोटिक रसोई" (औपचारिक कंप्यूटर प्रणाली) के बीच एक सेतु बनाने के बारे में है।
तीन मुख्य पात्र
- वैज्ञानिक (मानव-इन-द-लूप): वे भौतिकी को जानते हैं, लेकिन वे कंप्यूटर प्रोग्रामर नहीं हैं। वे "संपादक-इन-चीफ" के रूप में कार्य करते हैं, जो यह जाँचते हैं कि अनुवाद सार्थक है या नहीं।
- एजेंट (AI अनुवादक): एक AI जो रेसिपी का अनुवाद करने की कोशिश करता है। यह केवल एक अनुवादक नहीं है; यह एक "एजेंट" है जो अनुवाद करने की कोशिश कर सकता है, देख सकता है कि क्या रोबोट ने इसे खारिज कर दिया, और फिर अपनी गलतियों को सुधारने के लिए फिर से प्रयास कर सकता है।
- प्रूवर (रोबोट): एक औपचारिक प्रणाली (Lean4) जो कहती है या तो "परफेक्ट, यह गणितीय रूप से निश्चित है" या "त्रुटि! मुझे नहीं पता कि 'स्वप्निल प्याज' क्या है।"
"अनुवाद विचलन" (The Translation Drift) की समस्या (शोध पत्र का मूल)
शोधकर्ताओं ने एक दिलचस्प और थोड़ी डरावनी समस्या की खोज की जिसे वे "सेमेंटिक ड्रिफ्ट" (Semantic Drift) कहते हैं।
कल्पना कीजिए कि आप एक "गरजते हुए, राजसी शेर" के बारे में कविता का एक तकनीकी मैनुअल में अनुवाद कर रहे हैं जो चिड़ियाघर के लिए है। मैनुअल को "सही" और "कार्यात्मक" बनाने के लिए, आप बस लिख सकते हैं: "बड़ा मांसाहारी जीव, वजन: 190 किलोग्राम।"
तकनीकी रूप से, मैनुअल सही है (शेर वास्तव में एक बड़ा मांसाहारी जीव ही है), लेकिन आपने कविता की आत्मा खो दी है। आप अर्थ से केवल नग्न तथ्यों की ओर "विचलित" (drifted) हो गए हैं।
भौतिकी में, शोधकर्ताओं ने इस "विचलन" के तीन प्रकार पाए:
- नोटेशनल कोलैप्स (The "Shrinking" Effect - संकेतन पतन): आप एक जटिल क्वांटम ब्रह्मांड का वर्णन कर रहे हैं जहाँ कण विशिष्ट तरीकों से नाचते हैं, लेकिन कंप्यूटर इसे इतना सरल बना देता है कि यह उन्हें केवल साधारण संख्याओं की तरह मानता है। यह एक 3D मूवी को ब्लैक-एंड-व्हाइट स्केच में बदलने जैसा है। यह "सही" है, लेकिन भौतिकी गायब है।
- एब्स्ट्रैक्शन एलीवेशन (The "Skipping" Effect - अमूर्तन उत्थान): यह गणना करने का कठिन काम करने के बजाय कि गुरुत्वाकर्षण एक ग्रह को कैसे खींचता है, AI बस कंप्यूटर को बताता है: "मान लें कि गुरुत्वाकर्षण काम करता है।" कंप्यूटर कहता है, "ठीक है, मैं सहमत हूँ!" और हरी झंडी दे देता है। गणित वैध है, लेकिन वास्तविक "भौतिकी" पूरी तरह से छोड़ दी गई थी।
- इम्प्लिसिट प्रिमिस सिलेक्शन (The "Hidden Hero" - अंतर्निहित धारणा चयन): यह इस प्रकार का अच्छा विचलन है! कभी-कभी, AI को एहसास होता है कि वैज्ञानिक एक छोटी सी बात बताना भूल गए हैं (जैसे कि "सुनिश्चित करें कि आप शून्य से विभाजित न करें" )। AI इस विवरण को जोड़ देता है, जिससे प्रमाण मूल मानव संस्करण की तुलना में और भी मजबूत हो जाता है।
यह क्यों मायने रखता है?
अभी, AI निबंध लिखने में बहुत अच्छा है, लेकिन यह गणित और विज्ञान के "कठोर सत्य" के साथ संघर्ष करता है। यदि कोई AI किसी वैज्ञानिक को बताता है, "इस फ्यूजन रिएक्टर के लिए यह नया फॉर्मूला गणितीय रूप से सिद्ध है," तो वैज्ञानिक को यह जानने की आवश्यकता है: क्या AI ने वास्तव में भौतिकी को सिद्ध किया है, या इसने समस्या को इतना सरल बनाकर "चीटिंग" की है कि वह आसान हो गई?
FormalPhysics डेटासेट और FormalScience पाइपलाइन बनाकर, इन शोधकर्ताओं ने भविष्य के AI को बेहतर अनुवादक बनाने के लिए प्रशिक्षित करने का एक तरीका प्रदान किया है—यह सुनिश्चित करते हुए कि जब हम मानव विचार की "स्वप्निल" दुनिया से औपचारिक प्रमाण की "रोबोटिक" दुनिया में जाएँ, तो हम उस जादू (या सत्य) को रास्ते में न खो दें।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।