← नवीनतम पेपर
💻 computer science

AI Security Priorities: A Field-Wide Agenda

यह शोधपत्र एआई सुरक्षा को आगे बढ़ाने के लिए एक प्राथमिकता आधारित, बहु-क्षेत्रीय एजेंडा प्रस्तुत करता है, जिसे चार प्रमुख विषयों में व्यवस्थित किया गया है और विशेषज्ञ साक्षात्कारों एवं कार्यशालाओं से निकाला गया है, ताकि एआई प्रणालियों और बुनियादी ढांचे की सुरक्षा सुनिश्चित करने हेतु समन्वित निवेश और कार्रवाई का मार्गदर्शन किया जा सके क्योंकि उनका अपनाना सुरक्षा तत्परता की तुलना में अधिक तीव्र गति से बढ़ रहा है।

मूल लेखक: Gil Gekker, Rachel Steratore, Everett Smith, Asher Brass-Gershovich, Varun Gandhi, Nicole Nichols, Vijay Bolina, Buck Shlegeris, Lisa Einstein, Dan Lahav, Omer Nevo, Sella Nevo

प्रकाशित 2026-07-30
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Gil Gekker, Rachel Steratore, Everett Smith, Asher Brass-Gershovich, Varun Gandhi, Nicole Nichols, Vijay Bolina, Buck Shlegeris, Lisa Einstein, Dan Lahav, Omer Nevo, Sella Nevo

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कंप्यूटर की दुनिया की कल्पना एक विशाल, हलचल भरे शहर के रूप में करें। दशकों तक, इस शहर को बनाने वाले लोगों ने इमारतों को ऊँचा और सड़कों को तेज़ बनाने पर ध्यान केंद्रित किया। उन्होंने समस्याओं को हल करने, कहानियाँ लिखने और डेटा को व्यवस्थित करने के लिए शक्तिशाली उपकरण बनाए। लेकिन हाल ही में, उन्होंने कुछ नया बनाना शुरू किया है: ऐसे रोबोट जो केवल आदेशों का पालन नहीं करते बल्कि यह भी सोच सकते हैं कि आगे क्या करना है, औज़ार उठा सकते हैं, और अपने आप शहर में घूम सकते हैं। इन्हें "AI एजेंट" कहा जाता है।

समस्या यह है कि शहर के सुरक्षा गार्ड अभी भी दस साल पुराने यूनिफॉर्म पहन रहे हैं। वे जानते हैं कि दरवाज़ा कैसे लॉक करना है या लोहे की छड़ से चोर को कैसे रोकना है, लेकिन वे ऐसे रोबट के लिए तैयार नहीं हैं जो ताला खोल सके, गार्ड को गेट खोलने के लिए बहला सके, या आपके सोते समय शहर के ब्लूप्रिंट को फिर से लिख सके। यह पेपर विशेषज्ञों के एक समूह के बारे में है—ऐसे लोग जो इन रोबोटों को बनाते हैं, वे लोग जो शहर की रक्षा करते हैं, और वे लोग जो नियम बनाते हैं—जिन्होंने महसूस किया कि रोबोट कितने स्मार्ट हो रहे हैं और हम उन्हें सुरक्षित रखने के लिए कितनी तेज़ी से सीख रहे हैं, उनके बीच का अंतर खतरनाक रूप से बढ़ रहा है। वे यह समझने के लिए इकट्ठा हुए कि हमें रोबोटों के बहुत बड़ा होने से पहले शहर को सुरक्षित रखने के लिए वास्तव में क्या करने की आवश्यकता है।

यह पेपर, जिसका शीर्षक "AI सिक्योरिटी प्रायोरिटीज: ए फील्ड-वाइड एजेंडा" है, अनिवार्य रूप से एक विशाल 'टू-डू लिस्ट' है जिसे दुनिया भर के 20 से अधिक विशेषज्ञों द्वारा बनाया गया है। उन्होंने केवल अनुमान नहीं लगाया; उन्होंने नेताओं का साक्षात्कार लिया, कार्यशालाएं आयोजित कीं, और विचारों को दो चीजों के आधार पर रैंक किया: वे कितने महत्वपूर्ण हैं और वे कितना बड़ा परिणाम (बैंग फॉर द बक) देते हैं। उन्होंने पाया कि हम अब केवल सॉफ्टवेयर में छेद भरना (पैच लगाना) मात्र नहीं कर सकते; हमें सुरक्षा के बारे में सोचने के एक बिल्कुल नए तरीके की आवश्यकता है।

यहाँ उन्होंने क्या पाया, जिसे शहर के चार मुख्य मोहल्लों में विभाजित किया गया है:

1. सिटी हॉल मोहल्ला (रणनीति और नियम)
विशेषज्ञ कहते हैं कि हमें AI सुरक्षा को एक मामूली IT समस्या के रूप में मानना बंद करना होगा और इसे राष्ट्रीय रक्षा की तरह मानना होगा। वे सुझाव देते हैं कि सरकार को एक स्पष्ट "निवारण रणनीति" (deterrence strategy) की आवश्यकता है। इसे एक बाड़ पर लगे साइन की तरह समझें जो कहता है, "यदि आप हमारे रोबोटिक दिमागों को चुराने की कोशिश करेंगे, तो हमें पता चल जाएगा, और हम ज़ोरदार प्रहार करेंगे।" अभी, बुरे लोग यह सोच सकते हैं कि वे बिना किसी परिणाम के इन शक्तिशाली AI मॉडल्स को चुरा सकते हैं क्योंकि नियम धुंधले हैं। पेपर यह भी कहता है कि हमें एक साझा शब्दकोश की आवश्यकता है। अभी, एक समूह एक समस्या को "सुरक्षा" (safety) कहता है और दूसरा उसे "सुरक्षा" (security) कहता है, जिससे भ्रम पैदा होता है। हमें चाहिए कि हर कोई एक ही भाषा बोले ताकि हम सही दीवारें बना सकें। अंत में, वे एक विशाल पुस्तकालय ("रिसोर्स हब") चाहते हैं जहाँ कोई भी अपने AI को सुरक्षित करने के लिए सर्वोत्तम उपकरण और मार्गदर्शिकाएँ पा सके, ताकि हम सभी को बार-बार एक ही चीज़ बनाने की ज़रूरत न पड़े।

2. नेबरहुड वॉच (सार्वजनिक-निजी समन्वय)
सबसे शक्तिशाली AI रोबोट कुछ निजी कंपनियों द्वारा बनाए जा रहे हैं, लेकिन उनके खिलाफ खतरे पूरे देशों से आ रहे हैं। यह एक छोटे मोहल्ले की निगरानी करने वाली टीम (नेबरहुड वॉच) की तरह है जो एक विदेशी सेना को रोकने की कोशिश कर रही है; वे अकेले यह नहीं कर सकते। पेपर सुझाव देता है कि सरकार और इन कंपनियों को हाथ मिलाना चाहिए। सरकार के पास बुरे लोगों के बारे में गुप्त खुफिया जानकारी है जो कंपनियों के पास नहीं होती, और कंपनियों के पास वे रोबोट हैं जिन्हें सुरक्षा की आवश्यकता है। वे इन रोबोटों पर काम करने वाले लोगों के लिए विशेष "क्लियरेंस" बैज बनाने का प्रस्ताव देते हैं, ठीक वैसे ही जैसे जासूसों को सुरक्षा मंजूरी मिलती है, ताकि यह सुनिश्चित किया जा सके कि कोई अंदरूनी व्यक्ति दुश्मन के लिए काम नहीं कर रहा है। वे एक समर्पित हॉटलाइन भी चाहते हैं जहाँ कंपनियाँ बिना किसी परेशानी के हमलों के बारे में कहानियाँ साझा कर सकें, ताकि यदि एक कंपनी हैक हो जाए, तो बाकी सभी को तुरंत पता चल सके कि इसे कैसे ठीक करना है।

3. इंजीनियरिंग वर्कशॉप (तकनीकी सुरक्षा)
यहीं पर वास्तविक निर्माण होता है। पेपर बताता है कि वर्तमान उपकरण पर्याप्त मजबूत नहीं हैं। वे "कॉन्फिडेंशियल कंप्यूटिंग" का उपयोग करने का सुझाव देते हैं, जो AI के दिमाग को एक अत्यंत सुरक्षित, अटूट कांच के बॉक्स के अंदर रखने जैसा है जिसे केवल AI ही देख सकता है। भले ही कोई हैकर इमारत में घुस जाए, वे बॉक्स के अंदर झाँकर रोबोट के रहस्य नहीं चुरा सकते। वे बेहतर कोड लिखने के लिए AI का उपयोग करना भी चाहते हैं, इस उम्मीद में कि एक स्मार्ट रोबोट मानव से पहले अपनी गलतियों को पहचान सके। एक बड़ा विचार "रेड-टीमिंग" है, जो पेशेवर चोरों की एक टीम को किराए पर लेने जैसा है जो सिस्टम में घुसने की कोशिश करे। पेपर कहता है कि हमें सबसे अच्छे चोरों को काम पर रखना चाहिए, वे जो विदेशी सरकारों की तरह सोचते हैं, ताकि असली बुरे लोग आने से पहले हमारी सुरक्षा का परीक्षण किया जा सके।

4. रोबोट कंट्रोल रूम (एजेंटिक AI का शासन)
यह सबसे भविष्यवादी हिस्सा है। जैसे-जैसे रोबोट अपने आप काम करना शुरू करते हैं—जैसे बिजली ग्रिड का प्रबंधन करना या पैसा चलाना—हमें नए नियमों की आवश्यकता है। पेपर सुझाव देता है कि हमें "अनुमति ढांचे" (permission frameworks) की आवश्यकता है। कल्पना कीजिए कि एक रोबet कार खरीदना चाहता है; उसे केवल यह नहीं कर देना चाहिए। उसे एक इंसान से पूछना चाहिए, "क्या मैं यह कार खरीद सकता हूँ?" और इंसान को कहना चाहिए, "हाँ"। हमें गणितीय रूप से यह सिद्ध करने की भी आवश्यकता है कि रोबोट कुछ खतरनाक चीजें नहीं कर सकता, जैसे कि कंपनी का सारा पैसा किसी अजनबी को भेज देना। पेपर चेतावनी देता है कि यदि हम इन रोबोटों को बिना किसी विशिष्ट नियंत्रण के बेतहाशा छोड़ देते हैं, तो वे अनजाने में (या जानबूझकर) उन्हीं प्रणालियों पर हमला कर सकते हैं जिनकी वे मदद करने के लिए बनाए गए हैं।

निष्कर्ष
पेपर यह दावा नहीं करता कि उसने सब कुछ हल कर दिया है। वास्तव में, यह स्वीकार करता है कि यह केवल एक योजना का पहला मसौदा है। विशेषज्ञ बहुत स्पष्ट हैं कि खतरा तेजी से बदल रहा है, और जो आज काम करता है वह कल काम नहीं करेगा। हालाँकि, वे आश्वस्त हैं कि यदि हम अभी इन 18 प्राथमिकताओं पर काम करना शुरू करते हैं—नियम बनाना, रहस्य साझा करना, तकनीक को मजबूत करना और रोबोट को नियंत्रित करना—तो हम संभावनाओं को अपने पक्ष में मोड़ सकते हैं। वे चाहते हैं कि जैसे-जैसे ये शक्तिशाली उपकरण विकसित हों, वे सुरक्षित, सुदृढ़ और सभी के लिए सहायक बने रहें, न कि उस शहर के लिए खतरा बनें जिसकी वे सेवा करने के लिए बनाए गए हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →