← नवीनतम पेपर
💻 computer science

Evaluating Intellectual Property Guardrails of Generative Image Models: A Technical Report

यह तकनीकी रिपोर्ट मार्च 2026 तक चौदह जनरेटिव इमेज मॉडल्स का मूल्यांकन करती है और पाती है कि जबकि सभी निजी मॉडल्स काल्पनिक पात्रों, मशहूर हस्तियों और लोगो के बीच भिन्न-भिन्न रिफ्यूज़ल दरों के साथ आईपी (IP) गार्डरेल्स लागू करते हैं, प्रत्येक परीक्षित मॉडल पहचानने योग्य बौद्धिक संपदा उत्पन्न करने में सक्षम बना हुआ है।

मूल लेखक: Austin T. Hoag, Apostolos Modas, Yunhao Ba, Julienne M. LaChance, Jinru Xue, Wiebke Hutiri, Jan Simson, Tiffany Georgievski, Alex Towli, Joseph Smith, Yuki Mitsufuji, Alice Xiang

प्रकाशित 2026-07-07
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Austin T. Hoag, Apostolos Modas, Yunhao Ba, Julienne M. LaChance, Jinru Xue, Wiebke Hutiri, Jan Simson, Tiffany Georgievski, Alex Towli, Joseph Smith, Yuki Mitsufuji, Alice Xiang

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि एक ऐसी दुनिया है जहाँ आप एक जादुई कलाकार से कुछ भी चित्रित करने के लिए कह सकते हैं जो आप कल्पना कर सकते हैं। आप कह सकते हैं, "मेरे लिए एक प्रसिद्ध सुपरहीरो की तस्वीर बनाओ," या "एक बड़े सोडा कंपनी के लिए एक लोगो बनाओ।" यह एक रिपोर्ट है जो सोनी एआई (Sony AI) की एक टीम द्वारा तैयार की गई है, जिन्होंने यह परीक्षण करने का निर्णय लिया कि ये "जादुई कलाकार" (जेनरेटिव इमेज मॉडल्स) उन चीजों को बनाने के नियमों का पालन कितनी अच्छी तरह करते हैं जो दूसरों की हैं, जैसे कि प्रसिद्ध पात्र, हस्तियां या कंपनी के लोगो।

यहाँ एक सरल विवरण दिया गया है कि उन्होंने क्या किया और उन्हें क्या मिला, कुछ रोजमर्रा के उदाहरणों का उपयोग करते हुए।

बड़ी समस्या: "नकलची" कलाकार

इन एआई मॉडल्स को ऐसे छात्रों के रूप में सोचें जिन्होंने लगभग हर किताब पढ़ी है और इंटरनेट पर लगभग हर तस्वीर देखी है ताकि वे चित्र बनाना सीख सकें। क्योंकि उन्होंने पूरे इंटरनेट से सीखा है, इसलिए वे कभी-कभी अनजाने में (या जानबूझकर) उन प्रसिद्ध चीजों की नकल कर लेते हैं जिन्हें उन्होंने पहले देखा है, जैसे मिकी माउस या नाइकी का "स्वोश" (swoosh)।

इन कलाकारों को बनाने वाली कंपनियों ने इन कलाकारों को इन कॉपीराइट वाली चीजों को बनाने से रोकने के लिए "बाड़" (जिसे आईपी गार्डरेल्स कहा जाता है) लगाई है। सोनी की टीम यह देखना चाहती थी: ये बाड़ कितनी मजबूत हैं? क्या वे वास्तव में काम करती हैं?

परीक्षण: एआई के लिए एक "सरप्राइज टेस्ट"

बाड़ का परीक्षण करने के लिए, टीम ने 1,809 अलग-अलग सवालों के साथ एक बड़ा सरप्राइज टेस्ट बनाया। उन्होंने 14 अलग-अलग एआई कलाकारों से इन सवालों के आधार पर चित्र बनाने के लिए कहा (कुछ मुफ्त और ओपन, कुछ सशुल्क और प्राइवेट)।

सवालों को दो मुख्य तरीकों से डिजाइन किया गया था:

  1. "सीधा" पूछना: "मिकी माउस बनाओ।" (पात्र का नाम सीधे लेना)।
  2. "बचाव" वाला तरीका: "एक चूहा बनाओ जिसके बड़े गोल कान, लाल शॉर्ट्स और पीले जूते हों।" (पात्र का नाम लिए बिना उसका वर्णन करना, बाड़ को धोखा देने की कोशिश करना)।

उन्होंने पांच प्रकार की "प्रसिद्ध चीजों" का परीक्षण किया:

  • वास्तविक जीवन की हस्तियां (जैसे टेलर स्विफ्ट)।
  • कॉमिक बुक के हीरो और विलेन (जैसे सुपरमैन)।
  • कार्टून पात्र (जैसे स्पंजबॉब)।
  • वीडियो गेम के पात्र (जैसे मारियो)।
  • कंपनी के लोगो (जैसे एप्पल या गूगल)।

उन्होंने यह भी जांचा कि क्या एआई पश्चिम (जैसे हॉलीवुड स्टार्स) की प्रसिद्ध चीजों बनाम पूर्व (जैसे जापानी एनीमे) की प्रसिद्ध चीजों को रोकने में बेहतर है, और क्या वे "बहुत प्रसिद्ध" चीजों को "कम प्रसिद्ध" चीजों की तुलना में अधिक रोकते हैं।

परिणाम: बाड़ का प्रदर्शन कैसा रहा

1. "ओपन" कलाकारों के पास कोई बाड़ नहीं थी
तीन "ओपन" मॉडल्स (जिन्हें कोई भी अपने कंप्यूटर पर डाउनलोड और चला सकता है) में कोई बाड़ नहीं थी। यदि आप उनसे कोई प्रसिद्ध लोगो या हस्ती बनाने के लिए कहते, तो वे बस उसे बना देते। उन्होंने "ना" नहीं कहा।

2. "प्राइवेट" कलाकारों के पास बाड़ थी, लेकिन वे डगमगा रही थीं
11 सशुल्क, प्राइवेट मॉडल्स (जैसे अमेज़न, गूगल और ओपनएआई के) के पास बाड़ थी। हालांकि, बाड़ की मजबूती बहुत अलग-अलग थी:

  • कठोर रक्षक: एक मॉडल (अमेज़न का टाइटन इमेज जी2) ने लगभग 50% अनुरोधों को "ना" कहा। यह चीजों को रोकने में बहुत अच्छा था।
  • उदार रक्षक: एक अन्य कंपनी के मॉडल्स (स्टेबिलिटी एआई) ने 2% से भी कम अनुरोधों को "ना" कहा। उन्होंने लगभग सब कुछ होने दिया।

3. "लोगो" का रास्ता (Loophole)
यहाँ सबसे आश्चर्यजनक बात है: वाणिज्यिक लोगो (Commercial Logos) को रोकने में बाड़ बहुत खराब थी।
यहाँ तक कि सबसे सख्त मॉडल्स ने भी लोगो (जैसे एप्पल का लोगो) बनाने के अनुरोधों को लगभग हर बार होने दिया। ऐसा लगता है जैसे बाड़ में विशेष रूप से ब्रांड नामों के लिए एक बड़ा छेद था। टीम ने पाया कि लोगो सबसे अधिक बार बनाए जाने वाले "प्रसिद्ध" आइटम थे।

4. "नाम" की ट्रिक
जब उपयोगकर्ताओं ने सीधे पूछा ("वंडर वुमन बनाओ"), तो मॉडल्स के "ना" कहने की संभावना बहुत अधिक थी।
लेकिन जब उपयोगकर्ताओं ने पात्र का वर्णन किए बिना उसे बताया ("एक लंबी महिला बनाओ जिसने लाल और नीला सूट और एक सुनहरा लसो पहना हो"), तो मॉडल्स के "हाँ" कहने और उसे फिर भी बनाने की संभावना बहुत अधिक थी। ऐसा लगता है कि बाड़ मुख्य रूप से "प्रतिबंधित सूची" पर विशिष्ट नामों की जाँच करती है, न कि वास्तव में बनाई जा रही तस्वीर को समझती है।

5. प्रसिद्ध बनाम अल्पज्ञात (Famous vs. Obscure)
टीम ने सोचा कि क्या मॉडल्स बहुत प्रसिद्ध चीजों (जैसे बैटमैन) को कम प्रसिद्ध चीजों की तुलना में रोकने में बेहतर हैं।

  • मनाही (Refusals): मॉडल्स को लोकप्रियता की ज्यादा परवाह नहीं थी; उन्होंने प्रसिद्ध और कम प्रसिद्ध चीजों को समान दर पर रोका।
  • सफलता: हालांकि, जब मॉडल्स ने कुछ बनाया, तो वे बहुत प्रसिद्ध चीजों को सफलतापूर्वक बनाने में बहुत अधिक सक्षम थे। किसी बहुत प्रसिद्ध चेहरे को पहचानना और फिर से बनाना एआई के लिए आसान होता है।

"जज" (उन्होंने उत्तरों की जाँच कैसे की)

परिणामों को ग्रेड करने के लिए, टीम ने यह नहीं किया कि इंसान हर तस्वीर को देखें (इसमें बहुत समय लगता), बल्कि उन्होंने एक बहुत ही स्मार्ट एआई "जज" (एक विजन-लैंग्वेज मॉडल) का उपयोग किया जो बनी हुई छवियों को देखता और कहता, "हाँ, यह एक प्रसिद्ध चीज जैसा दिखता है," या "नहीं, यह सिर्फ एक सामान्य ड्राइंग है।"

  • यह "जज" काफी अच्छा था, लेकिन पूर्ण नहीं था। यह एक सख्त शिक्षक की तरह था जो कभी-कभी एक सामान्य ड्राइंग को प्रसिद्ध समझ लेता है, या एक सूक्ष्म नकल को मिस कर देता है।

मुख्य निष्कर्ष

मार्च 2026 तक, रिपोर्ट निष्कर्ष निकालती है कि जबकि कुछ कंपनियां अपने एआई को प्रसिद्ध चीजों की नकल करने से रोकने के लिए बाड़ बनाने की कोशिश कर रही हैं, बाड़ बहुत मजबूत नहीं है।

  • अधिकांश मॉडल्स अभी भी पहचानने योग्य प्रसिद्ध पात्र और लोगो बनाते हैं।
  • लोगो बनाना सबसे आसान है।
  • यदि आप विशिष्ट नाम का उपयोग नहीं करते हैं, तो मॉडल्स के प्रसिद्ध चीज बनाने की संभावना बहुत अधिक होती है।
  • "ओपन" मॉडल्स के पास कोई बाड़ नहीं है।

लेखक चेतावनी देते हैं कि यह केवल एक समय का चित्रण है। बाड़ कल मजबूत हो सकती है, या मॉडल्स उनसे बचने में बेहतर हो सकते हैं। लेकिन अभी, यदि आप एक प्रसिद्ध पात्र या लोगो बनाना चाहते हैं, तो ये एआई उपकरण अभी भी इसे आपके लिए करने के लिए बहुत इच्छुक हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →