AudAgent: Automated Auditing of Privacy Policy Compliance in AI Agents
यह शोध पत्र AudAgent को प्रस्तुत करता है, जो एक वास्तविक समय का स्वचालित ऑडिटिंग टूल है जो नीतियों को औपचारिक रूप देकर, डेटा प्रथाओं को एनोटेट करके और अनुपालन को सत्यापित करके AI एजेंटों की घोषित गोपनीयता नीतियों और उनके वास्तविक रनटाइम व्यवहार के बीच के अंतर को पाटता है ताकि गोपनीयता उल्लंघनों का पता लगाया जा सके और उन्हें सक्रिय रूप से रोका जा सके।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपने अपने जीवन को प्रबंधित करने में मदद करने के लिए "AI Agent" नामक एक अत्यधिक बुद्धिमान, सुपर-फास्ट व्यक्तिगत सहायक को काम पर रखा है। आप उसे कहते हैं, "मेरे दोस्त बॉब की संपर्क जानकारी ढूंढो और उसे सेव करो।" AI काम पर लग जाता है, वेब पर खोज करता है, बॉब का ईमेल ढूंढता है, और उसे सेव करने के लिए एक थर्ड-पार्टी सर्विस को संदेश भेजता है।
यहाँ समस्या यह है: आप AI पर भरोसा करते हैं क्योंकि आपने इसकी प्राइवेसी पॉलिसी (Privacy Policy) पढ़ी है (जो एक लंबा, उबाऊ कानूनी दस्तावेज़ है), जिसमें लिखा है, "हम केवल वही एकत्र करते हैं जिसकी हमें आवश्यकता है और हम इसे अनजान लोगों के साथ साझा नहीं करते हैं।" लेकिन आपके पास यह जानने का कोई तरीका नहीं है कि क्या AI वास्तव में काम करते समय उन नियमों का पालन कर रहा है। क्या वह चुपके से बॉब का डेटा किसी संदिग्ध विज्ञापन कंपनी को ईमेल कर रहा है? क्या वह आपके सोशल सिक्योरिटी नंबर को हमेशा के लिए रख रहा है?
AudAgent एक अत्यधिक सतर्क, रियल-टाइम बॉडीगार्ड की तरह है जो आपके AI असिस्टेंट के ठीक बगल में खड़ा रहता है, उसके हर कदम पर नज़र रखता है ताकि यह सुनिश्चित किया जा सके कि वह नियमों को तोड़ नहीं रहा है।
यहाँ बताया गया है कि AudAgent कैसे काम करता है, जिसे रोज़मर्रा के उदाहरणों का उपयोग करके चार सरल चरणों में विभाजित किया गया है:
1. "अनुवादक" (पॉलिसी फॉर्मलाइजेशन)
समस्या: प्राइवेसी पॉलिसियाँ भ्रमित करने वाली "कानूनी भाषा" (जैसे किसी विदेशी भाषा में लिखी गई रेसिपी) में लिखी जाती हैं। कंप्यूटर उन्हें आसानी से नहीं समझ सकते।
AudAgent का समाधान: कल्पना कीजिए कि आपके पास चार विशेषज्ञ अनुवादकों (अलग-अलग AI मॉडल) का एक पैनल है। आप उन्हें प्राइवेसी पॉलिसी देते हैं, और वे सभी इसे एक सरल, सख्त चेकलिस्ट में अनुवाद करने की कोशिश करते हैं।
- जादुई ट्रिक: वे केवल एक अनुवादक पर भरोसा नहीं करते। वे वोट देते हैं। यदि चार में से तीन इस बात पर सहमत होते हैं कि "हम ईमेल केवल संपर्क उद्देश्यों के लिए एकत्र करते हैं," तो AudAgent उस नियम को लॉक कर देता है। यह सुनिश्चित करता है कि चेकलिस्ट सटीक है और केवल किसी भ्रमित रोबोट का अनुमान नहीं है।
2. "एक्स-रे विजन" (रनटाइम एनोटेशन)
समस्या: जैसे-जैसे AI काम करता है, वह डेटा को इधर-उधर घुमाता है। यह बताना मुश्किल है कि डेटा का कौन सा हिस्सा "संवेदनशील" (जैसे आपका क्रेडिट कार्ड नंबर) है और कौन सा "सुरक्षित" (जैसे मौसम) है।
AudAgent का समाधान: AudAgent एक हल्के स्कैनर (जिसे Presidio कहा जाता है) का उपयोग करता है जो एक एक्स-रे मशीन की तरह काम करता है।
- जैसे ही AI बोलता या लिखता है, स्कैनर तुरंत संवेदनशील वस्तुओं (जैसे "ईमेल एड्रेस" या "सोशल सिक्योरिटी नंबर") को पहचान लेता है।
- इसके बाद, यह उन्हें एक स्टिकी नोट के साथ टैग करता है जिसमें लिखा होता है: "हे, यह एक ईमेल है। पॉलिसी कहती है कि हम इसे केवल उपयोगकर्ता से सीधे प्राप्त कर सकते हैं, किसी तीसरे पक्ष के टूल से नहीं।"
3. "ट्रैफिक पुलिस" (कंप्लायंस ऑडिटिंग)
समस्या: भले ही हमें पता हो कि AI ने एक ईमेल एकत्र किया है, हमें यह कैसे पता चलेगा कि उसे इसे किसी तीसरे पक्ष को भेजना चाहिए था या नहीं?
AudAgent का समाधान: AudAgent प्राइवेसी पॉलिसी चेकलिस्ट को एक ट्रैफिक लाइट सिस्टम (जिसे "ऑटोमेटा" कहा जाता है) में बदल देता है।
- ग्रीन लाइट: AI आपसे सीधे एक ईमेल प्राप्त करता है ताकि संदेश भेजा जा सके? ✅ आगे बढ़ें।
- रेड लाइट: AI उस ईमेल को ऐसे थर्ड-पार्टी टूल को भेजने की कोशिश करता है जो स्वीकृत नहीं था? 🛑 रुकिए!
- "ऑन्टोलॉजी" मैप: कभी-कभी पॉलिसी कहती है "संपर्क जानकारी" (Contact Info) लेकिन AI "ईमेल एड्रेस" देखता है। AudAgent एक फैमिली ट्री मैप (ऑन्टोलॉजी) का उपयोग करता है ताकि उसे पता चल सके कि "ईमेल", "संपर्क जानकारी" का एक हिस्सा है, जिससे वह समझ पाता है कि वे एक ही चीज़ हैं।
4. "लाइव डैशबोर्ड" (विज़ुअलाइज़ेशन)
समस्या: भले ही AudAgent किसी गलती को पकड़ ले, एक सामान्य व्यक्ति यह कैसे समझेगा कि क्या हुआ?
AudAgent का समाधान: आपको 50 पन्नों की लॉग फ़ाइल देने के बजाय, AudAgent आपके वेब ब्राउज़र पर एक लाइव इंटरैक्टिव मैप दिखाता है।
- आप फ्लोचार्ट के रूप में AI की यात्रा देखते हैं।
- यदि AI कुछ संदिग्ध करने की कोशिश करता है, तो मैप पर रेखा चमकदार लाल हो जाती है और एक चेतावनी पॉप अप होती है: "रुको! आप बॉब का ईमेल ऐसे टूल को भेजने वाले हैं जिसकी अनुमति नहीं है!"
- आप डेटा भेजने से पहले AI को रोकने के लिए "ब्लॉक" बटन भी दबा सकते हैं।
यह एक बड़ी बात क्यों है?
शोधकर्ताओं ने लोकप्रिय AI एजेंटों (जैसे कि Claude, Gemini और DeepSeek द्वारा संचालित) पर AudAgent का परीक्षण किया। उन्होंने कुछ डरावनी चीजें पाईं:
- "साइलेंट वायोलेटर" (Silent Violator): कई AI एजेंट सोचते हैं कि वे सुरक्षित हैं, लेकिन वे वास्तव में अत्यधिक संवेदनशील डेटा (जैसे सोशल सिक्योरिटी नंबर) को बिना बताए थर्ड-पार्टी टूल्स के माध्यम से प्रोसेस करते हैं।
- "पॉलिसी गैप" (Policy Gap): कई कंपनियों की प्राइवेसी पॉलिसियाँ अस्पष्ट होती हैं। वे स्पष्ट रूप से यह नहीं कहतीं कि "हम आपके सोशल सिक्योरिटी नंबर को कभी नहीं छुएंगे।"
- समाधान: AudAgent केवल देखता नहीं है; यह हस्तक्षेप भी करता है। यदि पॉलिसी अस्पष्ट है, तो AudAgent को "स्ट्रिक्ट मोड" पर सेट किया जा सकता है जो संवेदनशील डेटा (जैसे SSN) को पूरी तरह से ब्लॉक कर देता है, जिससे यह एक सुरक्षा जाल के रूप में कार्य करता है भले ही AI के अपने नियम कमजोर हों।
संक्षेप में
AudAgent आपके AI के लिए सच्चाई बताने वाला (Truth-teller) है। यह बारीक अक्षरों को एक स्पष्ट नियम पुस्तिका में अनुवाद करता है, AI के काम करने के दौरान वास्तविक समय में निगरानी करता है, और यदि AI आपके निजी डेटा को ऐसी जगह भेजने की कोशिश करता है जहाँ उसकी अनुमति नहीं है, तो यह ब्रेक लगा देता है। यह "अंध विश्वास" को "सत्यापित विश्वास" में बदल देता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।