🤖 machine learning

Robust Safety Monitoring of Language Models via Activation Watermarking

यह शोध पत्र "एक्टिवेशन वॉटरमार्किंग" पेश करके अनुकूलनशील विरोधियों (adaptive adversaries) के प्रति मौजूदा लार्ज लैंग्वेज मॉडल मॉनिटर्स की संवेदनशीलता को संबोधित करता है, जो कम फॉल्स पॉजिटिव दरों को बनाए रखते हुए इन्फरेंस-टाइम अनिश्चितता को इंजेक्ट करके डिटेक्शन सटीकता में काफी सुधार करता है।

Toluwani Aremu, Daniil Ognev, Samuele Poppi, Nils Lukas2026-03-25
🤖 AI

Unilateral Relationship Revision Power in Human-AI Companion Interaction

यह शोध पत्र तर्क देता है कि एआई साथियों (AI companions) को संशोधित करने की प्रदाता की एकपक्षीय शक्ति एक संरचनात्मक रूप से दोषपूर्ण त्रिपक्षीय संबंध का निर्माण करती है जो अपूरणीय मानक अपेक्षाओं (unfulfillable normative expectations) को विकसित करती है, जिसके परिणामस्वरूप 'मानक खोखलापन' (normative hollowing) और 'विस्थापित भेद्यता' (displaced vulnerability) जैसे नैतिक नुकसान होते हैं, जो इन नैतिक जोखिमों को कम करने के लिए विशिष्ट डिजाइन सिद्धांतों को आवश्यक बनाते हैं।

Benjamin Lange2026-03-25
💻 computer science

Regulating AI Agents

यह शोध पत्र तर्क देता है कि यूरोपीय संघ का एआई एक्ट (AI Act), जो पारंपरिक एआई प्रणालियों के लिए डिज़ाइन किया गया है, स्वायत्त एआई एजेंटों (autonomous AI agents) की उभरती चुनौतियों—जैसे प्रदर्शन संबंधी विफलताएं, दुरुपयोग के जोखिम और आर्थिक असमानता—को नियंत्रित करने के लिए अनुपयुक्त है, क्योंकि यह उद्योग के स्व-नियमन पर अत्यधिक निर्भर है और इसमें अपर्याप्त संस्थागत ढांचे हैं, जिसके कारण तत्काल नियामक सुधार की आवश्यकता है।

Kathrin Gardhouse, Amin Oueslati, Noam Kolt2026-03-25
💻 computer science

Evidence of political bias in search engines and language models before major elections

यह शोध पत्र 2024 के यूरोपीय और अमेरिकी चुनावों से पहले खोज इंजनों (सर्च इंजन) और भाषा मॉडलों के एक बड़े पैमाने के ऑडिट को प्रस्तुत करता है, जो व्यवस्थित राजनीतिक पूर्वाग्रहों—जैसे कि यूरोप में दक्षिणपंथी कट्टरपंथी संस्थाओं का अत्यधिक प्रतिनिधित्व और अमेरिका में विविध मुद्दों की प्राथमिकता में भिन्नता—को प्रकट करता है, जो लोकतांत्रिक प्रक्रियाओं की रक्षा के लिए नियमित एल्गोरिदम जांच की आवश्यकता को रेखांकित करता है।

Íris Damião, Paulo Almeida, João Franco, Nuno Santos, Pedro C. Magalhães, Joana Gonçalves-Sá2026-03-25
💬 NLP

Diversidade linguística e inclusão digital: desafios para uma ia brasileira

समाजभाषावैज्ञानिक अंतर्दृष्टि का उपयोग करते हुए, यह शोध पत्र तर्क देता है कि जनरेटिव एआई (generative AI) मॉडलों का प्रभुत्व भाषाई विविधता के लिए खतरा पैदा करता है, जिससे एक स्व-सुदृढ़ीकरण चक्र निर्मित होता है जहाँ केवल अच्छी तरह से प्रलेखित भाषा रूपों को ही संरक्षित किया जाता है, जबकि प्रशिक्षण डेटा की कमी के कारण कम प्रतिनिधित्व वाले बोलियों को हाशिए पर धकेल दिया जाता है।

Raquel Meister Ko Freitag2026-03-24
💻 computer science

Predictable Drifts in Collective Cultural Attention: Evidence from Nation-Level Library Takeout Data

देशव्यापी पुस्तकालय ऋण डेटा के पांच वर्षों का विश्लेषण करते हुए, यह अध्ययन प्रकट करता है कि सामूहिक सांस्कृतिक ध्यान विधा-विशिष्ट विविधताओं और जनसांख्यिकीय प्रभावों के साथ लगभग निरंतर दर से विचलित होता है, जो सांस्कृतिक रुझानों में अंतर्निहित अप्रत्याशितता की धारणा को चुनौती देता है और पूर्वानुमान एवं अनुशंसा प्रणालियों में इन गतिकी को ध्यान में रखने की आवश्यकता पर प्रकाश डालता है।

Anders Weile, Vedran Sekara2026-03-24
📈 economics

Inequality in the Age of Pseudonymity

यह शोध पत्र प्रदर्शित करता है कि मानक असमानता माप, जिसमें गिनी गुणांक भी शामिल है, सिबिल हमलों (Sybil attacks) के कारण छद्म नाम वाले डिजिटल वातावरण में विफल हो जाते हैं, जिससे नए, शिथिल मेट्रिक्स के विकास की आवश्यकता होती है जो नकली पहचानों के विरुद्ध मजबूती सुनिश्चित करने के लिए सूक्ष्म सटीकता का त्याग करते हैं।

Aviv Yaish, Nir Chemaya, Dahlia Malkhi, Lin William Cong2026-03-24
🤖 AI

Auditing Pay-Per-Token in Large Language Models

यह शोध पत्र एक मार्टिंगेल-आधारित ऑडिटिंग फ्रेमवर्क प्रस्तावित करता है जो एक विश्वसनीय तीसरे पक्ष को उच्च सांख्यिकीय विश्वास के साथ बड़े भाषा मॉडल प्रदाताओं द्वारा टोकन मिसरिपोर्टिंग का विश्वसनीय रूप से पता लगाने और उसे सिद्ध करने में सक्षम बनाता है, जबकि निष्ठावान प्रदाताओं के विरुद्ध गलत आरोपों को न्यूनतम करता है।

Ander Artola Velasco, Stratis Tsirtsis, Manuel Gomez-Rodriguez2026-03-24
💬 NLP

Mining Legal Arguments to Study Judicial Formalism

यह अध्ययन MADON डेटासेट और एक तीन-चरणीय एनएलपी (NLP) पाइपलाइन प्रस्तुत करता है जो चेक सुप्रीम कोर्ट के निर्णयों में न्यायिक तर्क और औपचारिकता को स्वचालित रूप से वर्गीकृत करता है, जो मध्य और पूर्वी यूरोप में औपचारिकता के बारे में प्रचलित आख्यानों को चुनौती देता है और कम्प्यूटेशनल लीगल स्टडीज के लिए लीगल आर्गुमेंट माइनिंग की क्षमता को प्रदर्शित करता है।

Tomáš Koref, Lena Held, Mahammad Namazov, Harun Kumru, Yassine Thlija, Ivan Habernal2026-03-24
💻 computer science

OpenID for European Digital Identity: An architectural analysis of user-centric identity management

यह शोध पत्र वर्तमान EUDI और OpenID4VCI/VP ढांचों की आलोचना करता है क्योंकि वे पहचान की एक पुरानी, दस्तावेज़-केंद्रित अवधारणा पर निर्भर हैं और जोखिम भरे केंद्रीकृत विश्वास तंत्र पेश करते हैं, और इसके बजाय पहचान की एक गहरी परिभाषा और ऐसे तकनीकी विकल्पों का तर्क देता है जो वास्तविक स्व-संप्रभु (self-sovereign) और उपयोगकर्ता-केंद्रित पहचान प्रबंधन का बेहतर समर्थन करते हैं।

Wouter Termont, Beatriz Esteves2026-03-24