← नवीनतम पेपर
💬 NLP

Probing Stylistic Appropriation using Large Language Models: An Evaluation Framework for Copyright Infringement under EU Law

यह शोध पत्र PSALM को प्रस्तुत करता है, जो एक नवीन LLM-as-a-judge ढांचा है जो शैलीगत विनियोग (stylistic appropriation) का मूल्यांकन करने के लिए यूरोपीय संघ के कॉपीराइट सिद्धांत को क्रियान्वित करता है, यह प्रकट करते हुए कि केवल शाब्दिक स्मृति (verbatim memorization) पर केंद्रित वर्तमान सुरक्षा उपाय फाइन-ट्यून किए गए मॉडलों द्वारा उत्पन्न नैरेटिव पैटर्न और रचनात्मक तत्वों में व्यवस्थित उल्लंघन का पता लगाने में विफल रहते हैं।

मूल लेखक: Noah Scharrenberg, Chang Sun

प्रकाशित 2026-07-01
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Noah Scharrenberg, Chang Sun

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

यहाँ सरल भाषा और रचनात्मक उपमाओं (analogies) का उपयोग करके शोध पत्र (paper) का विवरण दिया गया है।

बड़ी समस्या: "वाइब" (Vibe) की नकल करना बनाम शब्दों की नकल करना

कल्पना कीजिए कि आप एक शेफ हैं जो एक प्रसिद्ध कुकबुक पढ़कर खाना बनाना सीख रहे हैं।

  • जाँच करने का पुराना तरीका: वर्तमान तकनीक एक सख्त लाइब्रेरियन की तरह काम करती है। यह केवल यह जाँचती है कि क्या आपने रेसिपी के शब्द-दर-शब्द नकल की है। यदि आपने कुछ शब्द बदल दिए या वाक्यों को आगे-पीछे कर दिया, तो लाइब्रेरियन कहता है, "आपने इसकी नकल नहीं की है! आप सुरक्षित हैं।"
  • कानूनी वास्तविकता: यूरोपीय कॉपीराइट कानून एक फूड क्रिटिक (खाद्य समीक्षक) की तरह है। क्रिटिक को केवल सटीक शब्दों की परवाह नहीं होती; उन्हें शैली (style), स्वाद (flavor), प्लेटिंग (plating), और उस अनोखे तरीके की परवाह होती है जिससे शेफ अपने व्यंजन की कहानी बताता है। यदि आप किसी प्रसिद्ध शेफ की अनूठी "आवाज़" और "पद्धति" को अपना बताकर पेश करते हैं, भले ही आपने सामग्री थोड़ी बदल दी हो, तो कानून कहता है कि आप अभी भी उनके कॉपीराइट का उल्लंघन कर सकते हैं।

अंतराल (The Gap): यहाँ एक बेमेल स्थिति है। तकनीक कहती है, "कोई सटीक शब्द कॉपी नहीं हुआ, इसलिए यह ठीक है।" कानून कहता है, "लेकिन शैली और कहानी चोरी हुई है।"

समाधान: PSALM (डिजिटल फूड क्रिटिक)

लेखकों ने PSALM (Probing Stylistic Appropriation by Language Models) नामक एक नया टूल बनाया है। PSALM को AI फूड क्रिटिक्स की एक टीम के रूप में समझें, जिन्हें कॉपीराइट कोर्ट में एक जज की तरह कार्य करने के लिए डिज़ाइन किया गया है।

केवल शब्दों की गिनती करने के बजाय, PSALM एक कहानी के 10 अलग-अलग "स्वादों" (flavors) को देखता है:

  1. लेखन शैली (Writing Style): क्या वाक्य की लय और शब्दावली मूल लेखक जैसी महसूस होती है?
  2. कथा स्वर (Narrative Voice): क्या कहानी एक ही दृष्टिकोण से सुनाई जा रही है (जैसे, एक चिड़चिड़े बूढ़े आदमी बनाम एक जिज्ञासु बच्चे का दृष्टिकोण)?
  3. पात्र (Characters): क्या व्यक्तित्व, प्रेरणाएँ और संबंध समान हैं?
  4. कथानक (Plot): क्या घटनाओं का क्रम और मोड़ (twists) वही हैं?
  5. विश्व निर्माण (World Building): क्या दुनिया के नियम (जादुई प्रणालियाँ, भूगोल, संस्कृति) कॉपी किए गए हैं?
  6. बचाव (Defenses): PSALM यह भी जाँचता है कि क्या नई कहानी एक पैरोडी (मूल का मज़ाक उड़ाना) है, एक पेस्टिच (एक प्रेमपूर्ण श्रद्धांजलि), या एक उद्धरण (स्रोत का उल्लेख) है।

PSALM 0 से 10 तक का स्कोर देता है। उच्च स्कोर का अर्थ है कि AI ने शैली का "विनियोग" (appropriated) किया है, भले ही उसने शब्दों की नकल न की हो।

प्रयोग: एक AI को एक विशिष्ट लेखक बनने के लिए सिखाना

शोधकर्ताओं ने इसका परीक्षण Llama 3.2 पर किया, जो एक लोकप्रिय AI मॉडल है। उन्होंने इसे पुरानी डच साहित्य पर आधारित प्रश्न-उत्तर के डेटासेट का उपयोग करके प्रशिक्षित (fine-tuned) किया।

परिणाम:

  1. प्रशिक्षण से पहले: AI एक सामान्य विशेषज्ञ शेफ की तरह था। इसके पास एक सामान्य शैली थी।
  2. प्रशिक्षण के बाद: AI एक नकलची (mimic) बन गया। जब इसे कहानी लिखने के लिए कहा गया, तो इसने केवल विशिष्ट वाक्यों को याद नहीं किया; इसने पूरी तरह से पुराने डच लेखकों की व्यक्तित्व, आवाज़ और कथानक संरचना को अपना लिया।
    • उपमा: यह केवल कुकबुक को पढ़ नहीं रहा था; यह बिल्कुल उसी प्रसिद्ध शेफ की तरह खाना पकाने लगा था, जिसमें वही अनूठी तकनीक और प्रस्तुति का उपयोग किया गया था, भले ही सामग्री थोड़ी अलग थी।
    • मुख्य निष्कर्ष: यह "शब्द-दर-शब्द" टेस्ट में पास हो गया (इसने सटीक वाक्य कॉपी नहीं किए), लेकिन PSALM ने इसे लेखक की शैली और कहानी की संरचना चुराने के लिए 10/10 दिया।

"अनलर्निंग" (Unlearning) का प्रयास: क्या आप एक शैली को भूल सकते हैं?

इसके बाद शोधकर्ताओं ने नेगेटिव प्रेफरेंस ऑप्टिमाइजेशन (NPO) नामक तकनीक का उपयोग करके AI को इन विशिष्ट पुस्तकों को "अनलर्न" (भूलने) करने की कोशिश की। इसे इस तरह समझें जैसे शेफ के दिमाग को रगड़कर साफ करना ताकि वह विशिष्ट रेसिपी भूल जाए।

परिणाम:

  • अच्छी खबर: AI ने सटीक शब्दों को कॉपी करना सफलतापूर्वक बंद कर दिया। यदि आप इसे कोई अनुच्छेद पढ़ने के लिए कहते, तो यह अब ऐसा नहीं कर पाता। "वर्बेटिम" (शब्दशः) स्कोर शून्य हो गया।
  • बुरी खबर: AI शैली को नहीं भूल पाया।
    • उपमा: आपने शेफ के दिमाग से विशिष्ट रेसिपी को तो मिटा दिया, लेकिन वे अभी भी मूल शेफ की सटीक अनूठी लय, प्लेटिंग शैली और स्वाद प्रोफाइल के साथ खाना बना रहे हैं।
    • PSALM ने अभी भी "अनलर्न्ड" AI को लेखक की आवाज़ और कहानी की संरचना चुराने के लिए उच्च स्कोर दिया। AI अभी भी मूल रचना के "बहुत समान" था, भले ही वह शब्दों की नकल नहीं कर रहा था।

निष्कर्ष

यह शोध पत्र निष्कर्ष निकालता है कि वर्तमान सुरक्षा उपकरण पर्याप्त नहीं हैं।

  • वर्तमान उपकरण: केवल यह जाँचते हैं कि क्या आपने शब्दों की नकल की है (जैसे एक लाइब्रेरियन जो सटीक टेक्स्ट की जाँच करता है)।
  • कानून: इस बात की परवाह करता है कि क्या आपने शैली और कहानी चुराई है (जैसे एक क्रिटिक जो वाइब की जाँच करता है)।
  • वास्तविकता: भले ही आप सटीक शब्दों को "अनलर्न" कर दें, AI अभी भी कॉपीराइट किए गए कार्य की शैली और संरचना को थामे रख सकता है।

सीख: AI के युग में वास्तव में कॉपीराइट का सम्मान करने के लिए, हमें केवल शब्दों की चोरी नहीं, बल्कि शैली और संरचना की चोरी को मापने और रोकने की आवश्यकता है। PSALM टूल इन "वाइब चोरों" को पकड़ने वाला सिस्टम बनाने की दिशा में एक पहला कदम है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →