← नवीनतम पेपर
💬 NLP

Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign

यह शोधपत्र RoSeMary को प्रस्तुत करता है, जो एक अभिनव ML/Crypto कोडसाइन फ्रेमवर्क है जो LLM-जनित कोड में सुदृढ़, कार्यात्मक और गोपनीयता-संरक्षित वॉटरमार्क को एम्बेड करने के लिए CodeT5 के साथ एंड-टू-एंड ट्रेनिंग और ज़ीरो-नॉलेज प्रूफ का उपयोग करता है, जो प्रभावी रूप से कम एंट्रॉपी और सुरक्षित सत्यापन की चुनौतियों का समाधान करता है।

मूल लेखक: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

प्रकाशित 2026-08-12
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

एक ऐसी दुनिया की कल्पना करें जहाँ कंप्यूटर केवल हमसे बातें ही नहीं करते, बल्कि वास्तव में हमारे डिजिटल जीवन के ब्लूप्रिंट (खाके) भी लिखते हैं। यह कोड के लिए लार्ज लैंग्वेज मॉडल्स (LLMs) का क्षेत्र है, जो सुपर-स्मार्ट एआई असिस्टेंट हैं जो केवल एक प्रॉम्प्ट पढ़कर सॉफ्टवेयर फंक्शन बना सकते हैं, बग्स ठीक कर सकते हैं और पूरे प्रोग्राम बना सकते हैं। लेकिन यहाँ एक पेच है: जब ये एआई कोड लिखते हैं, तो यह बताना अक्सर मुश्किल होता है कि वास्तव में इसका मालिक कौन है। क्या इसे एक मानव इंजीनियर ने लिखा था, या किसी एआई ने? और यदि एक एआई ने लिखा था, तो किस कंपनी का एआई? यह एक बड़ी बात है क्योंकि कोड मूल्यवान बौद्धिक संपदा (इंटेलेक्चुअल प्रॉपर्टी) है, जैसे कि कोई गुप्त रेसिपी या पेटेंट किया गया आविष्कार।

इसे हल करने के लिए, वैज्ञानिक एआई कोड को "वॉटरमार्क" करने की कोशिश कर रहे हैं। इसे एक डिजिटल अदृश्य स्याही या बैंक नोट पर छिपे हुए वॉटरमार्क की तरह समझें। आप यह साबित करना चाहते हैं कि, "हे, यह कोड मेरे एआई द्वारा बनाया गया है," बिना कोड के काम करने के तरीके को बदले। लेकिन एक समस्या है: कोड बहुत कठोर होता है। एक कहानी के विपरीत जहाँ आप शब्दों को समानार्थी शब्दों से बदल सकते हैं, कोड को चलने के लिए सख्त नियमों का पालन करना होता है। यदि आप गुप्त संदेश छिपाने के लिए बहुत अधिक बदलाव करते हैं, तो प्रोग्राम टूट जाता है। इसके अलावा, अदालत में स्वामित्व सिद्ध करने के लिए, आपको आमतौर पर न्यायाधीश को गुप्त कुंजी (वॉटरमार्क) दिखानी पड़ती है। लेकिन यदि आप कुंजी दिखाते हैं, तो बुरे लोग उसे चुरा सकते हैं और बाद में अपने स्वयं के वॉटरमार्क की नकल कर सकते हैं। यह "लुका-छिपी" का एक निराशाजनक खेल है जहाँ खेल के नियम इसे कुछ खोए बिना जीतना लगभग असंभव बना देते हैं।

यहीं पर RoSeMary नामक एक नया फ्रेमवर्क आता है, जो एक चतुर जादूगर की तरह काम करता है जो चाबी दिखाए बिना एक बंद बक्से में गुप्त संदेश छिपा सकता है। शोधकर्ताओं की टीम, जो कैलिफोर्निया विश्वविद्यालय, सैन डिएगो और सैन डिएगो स्टेट यूनिवर्सिटी के सदस्य हैं, ने एक ऐसा सिस्टम डिजाइन किया है जो मशीन लर्निंग (एआई वाला हिस्सा) को क्रिप्टोग्राफी (गुप्त गणित वाला हिस्सा) के साथ जोड़ता है। उन्होंने यह पता लगाया है कि कैसे एआई-जनरेटेड कोड में एक छिपा हुआ हस्ताक्षर डाला जाए जो हटाने में कठिन हो, कोड को पूरी तरह से काम करने दे और—सबसे महत्वपूर्ण रूप से—यह अनुमति दे कि मालिक स्वामित्व को सत्यापित कर सके बिना वास्तविक गुप्त हस्ताक्षर देखे।

यहाँ बताया गया है कि RoSeMary यह जादू कैसे करता है। सबसे पहले, यह CodeT5 नामक एक प्री-ट्रेन किए गए एआई मॉडल का उपयोग करता है, जो एक मास्टर शेफ की तरह है जिसने लाखों रेसिपी चखी हैं। कोड को बेतरतीब ढंग से बदलने के बजाय, यह शेफ कोड के "स्वाद" को समझता है। यह मूल कोड और एक गुप्त संदेश (वॉटरमार्क) लेता है और यह तय करता है कि कोड में सबसे अच्छा तरीका क्या होगा जिससे थोड़ा बदलाव किया जा सके—जैसे किसी वेरिएबल का नाम x से बदलकर item करना या एक while लूप को for लूप में बदलना—ताकि गुप्त संदेश इन छोटे बदलावों के भीतर छिपा रहे। क्योंकि शेफ को खाना पकाने के नियमों (प्रोग्रामिंग) का पता है, इसलिए कोड का स्वाद बिल्कुल वैसा ही रहता है (कोड पूरी तरह से काम करता है) भले ही उसमें गुप्त सामग्री डाली गई हो।

लेकिन असली जादू तब होता है जब यह जाँचने का समय आता है कि कोड प्रामाणिक है या नहीं। आमतौर पर, आपको न्यायाधीश को गुप्त रेसिपी सौंपनी पड़ती है। RoSeMary एक क्रिप्टोग्राफिक टूल का उपयोग करता है जिसे जीरो-नॉलेज प्रूफ (ZKP) कहा जाता है। कल्पना कीजिए कि आप अपने दोस्त को यह साबित करना चाहते हैं कि आप एक तिजोरी का संयोजन जानते हैं, लेकिन आप उन्हें नंबर नहीं बताना चाहते। आप उनके सामने तिजोरी खोल सकते हैं, उन्हें अंदर का खजाना दिखा सकते हैं, और फिर उसे फिर से बंद कर सकते हैं। वे जानते हैं कि आप संयोजन जानते हैं, लेकिन उन्होंने कभी नंबर नहीं देखे। RoSeMary कुछ ऐसा ही करता है। एआई मालिक एक जटिल गणितीय सर्किट चलाता है जो यह जाँचता है कि क्या छिपा हुआ हस्ताक्षर वहाँ मौजूद है। यह एक छोटा, डिजिटल "प्रूफ" उत्पन्न करता है जो कहता है, "हाँ, हस्ताक्षर वैध है," बिना यह बताए कि वह वास्तविक हस्ताक्षर वास्तव में क्या है।

टीम ने पायथन, जावा और C++ जैसी भाषाओं में हजारों कोड उदाहरणों पर इस सिस्टम का परीक्षण किया। उन्होंने पाया कि RoSeMary अपने काम में अविश्वसनीय रूप से अच्छा है। इसने 97.64% मामलों में सफलतापूर्वक वॉटरमार्क को छिपाया (अर्थात कोड अभी भी काम कर रहा था), और यह 0.97 के सटीकता स्कोर (जहाँ 1.0 पूर्ण है) के साथ वॉटरमार्क का पता लगा सका। यहाँ तक कि जब बुरे तत्वों ने वेरिएबल का नाम बदलकर या अन्य एआई का उपयोग करके कोड को फिर से लिखकर वॉटरमार्क को तोड़ने की कोशिश की, तब भी RoSeMary ने 98% बार छिपे हुए संदेश को खोज निकाला।

शायद सबसे प्रभावशाली हिस्सा इसकी गति और गोपनीयता है। सिस्टम स्वामित्व का प्रमाण लगभग 7.15 सेकंड में उत्पन्न कर सकता है, और एक न्यायाधीश केवल 118.6 मिलीसेकंड (एक पलक झपकने से भी कम समय) में उस प्रमाण को सत्यापित कर सकता है। महत्वपूर्ण रूप से, इस पूरी प्रक्रिया के दौरान, न्यायाधीश वास्तविक गुप्त वॉटरमार्क को कभी नहीं देखता है। इसका मतलब है कि मालिक एक ही वॉटरमार्क का बार-बार उपयोग कर सकता है बिना इस बात की चिंता किए कि कोई उसे चुरा लेगा और स्वामित्व का फर्जी दावा करने के लिए उसकी नकल करेगा।

संक्षेप में, RoSeMary उस तीन-तरफा खींचतान को हल करता है जिसने शोधकर्ताओं को लंबे समय से उलझा रखा था। यह कोड को काम करने लायक बनाए रखता है (फिडेलिटी/विश्वसनीयता), वॉटरमार्क को खोजने में आसान बनाता है (डिटेक्टेबिलिटी/पता लगाने की क्षमता), और इसे तोड़ना कठिन बनाता है (रोबस्टनेस/मजबूती), और यह सब करते हुए गुप्त कुंजी को बाहरी आँखों से सुरक्षित रखता है। यह एआई क्रांति की बौद्धिक संपदा की रक्षा करने की दिशा में एक महत्वपूर्ण कदम है, यह सुनिश्चित करते हुए कि जब एक एआई कोई उत्कृष्ट कृति लिखता है, तो कलाकार को वह श्रेय और सुरक्षा मिले जिसका वह हकदार है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →