🤖 AI

Automated Coding of Communication Data Using ChatGPT: Consistency Across Subgroups

यह अध्ययन प्रदर्शित करता है कि ChatGPT-आधारित संचार डेटा की कोडिंग लिंग और नस्लीय/जातीय उपसमूहों में निरंतर प्रदर्शन करती है, जो मानव रेटर विश्वसनीयता से मेल खाती है और बड़े पैमाने पर सहयोगात्मक मूल्यांकनों के लिए इसकी क्षमता को प्रमाणित करती है।

Jiangang Hao, Wenju Cui, Patrick Kyllonen, Emily Kerzabi2026-03-09
💬 NLP

DETECT: Determining Ease and Textual Clarity of German Text Simplifications

यह शोध पत्र DETECT प्रस्तुत करता है, जो सिंथेटिक LLM-जनित डेटा पर प्रशिक्षित और एक बड़े मानव-एनोटेटेड डेटासेट पर मान्य किया गया जर्मन-विशिष्ट मेट्रिक है, जो मौजूदा सामान्य-उद्देश्य वाले मेट्रिक्स की तुलना में सरलता, अर्थ संरक्षण और प्रवाह के संबंध में मानव निर्णयों के साथ बेहतर सहसंबंध प्रदर्शित करता है।

Maria Korobeynikova, Alessia Battisti, Lukas Fischer, Yingqiang Gao2026-03-09
💬 NLP

AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages

यह शोध पत्र AfriMTEB को प्रस्तुत करता है, जो 14 कार्यों और 38 डेटासेट के माध्यम से 59 अफ्रीकी भाषाओं को कवर करने वाला एक व्यापक बेंचमार्क है, साथ ही AfriE5 को भी प्रस्तुत करता है, जो क्रॉस-लिंगुअल कॉन्ट्रास्टिव डिस्टिलेशन के माध्यम से इन भाषाओं के लिए अनुकूलित एक अत्याधुनिक टेक्स्ट एम्बेडिंग मॉडल है।

Kosei Uemura, Miaoran Zhang, David Ifeoluwa Adelani2026-03-09
💬 NLP

Activation-Space Personality Steering: Hybrid Layer Selection for Stable Trait Control in LLMs

यह शोध पत्र एक नवीन हाइब्रिड लेयर चयन ढांचे का प्रस्ताव करता है जो प्रवाह या सामान्य क्षमताओं से समझौता किए बिना स्थिर, सटीक व्यवहार संबंधी स्टीयरिंग को सक्षम करने के लिए लो-रैंक सबस्पेस डिस्कवरी के माध्यम से एलएलएम (LLM) हिडन स्टेट्स से बिग फाइव व्यक्तित्व लक्षणों को निकालता है।

Pranav Bhandari, Nicolas Fay, Sanjeevan Selvaganapathy, Amitava Datta, Usman Naseem, Mehwish Nasim2026-03-09
💬 NLP

Critical Confabulation: Can LLMs Hallucinate for Social Good?

यह शोध पत्र "क्रिटिकल कॉन्फैब्युलेशन" (critical confabulation) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जहाँ LLMs को हाशिए पर रहे ऐतिहासिक व्यक्तित्वों के संबंध में अभिलेखीय अंतराल को भरने के लिए साक्ष्य-बद्ध, काल्पनिक आख्यान उत्पन्न करने हेतु निर्देशित किया जाता है, जो यह प्रदर्शित करता है कि नियंत्रित मतिभ्रम (controlled hallucinations) ऐतिहासिक सत्यनिष्ठा से समझौता किए बिना नैतिक ज्ञान उत्पादन में कैसे सहायता कर सकते हैं।

Peiqi Sui, Eamon Duede, Hoyt Long, Richard Jean So2026-03-09
🤖 machine learning

SPINE: Token-Selective Test-Time Reinforcement Learning with Entropy-Band Regularization

यह शोध पत्र SPINE का प्रस्ताव करता है, जो एक टोकन-चयनात्मक टेस्ट-टाइम सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो केवल उच्च-एन्ट्रॉपी वाले निर्णय-महत्वपूर्ण टोकन को एंट्रॉपी-बैंड नियमितीकरण के साथ अपडेट करके रीजनिंग मॉडल के प्रदर्शन में सुधार करता है, जिससे बाहरी लेबल या रिवॉर्ड मॉडल की आवश्यकता के बिना रिस्पॉन्स कोलैप्स को रोका जा सकता है और स्थिरता बढ़ाई जा सकती है।

Jianghao Wu, Yasmeen George, Jin Ye, Yicheng Wu, Daniel F. Schmidt, Jianfei Cai2026-03-09
🤖 AI

Window-based Membership Inference Attacks Against Fine-tuned Large Language Models

यह शोध पत्र WBC (विंडो-आधारित तुलना) को प्रस्तुत करता है, जो एक नवीन मेंबरशिप इन्फरेंस अटैक है जो साइन-आधारित एग्रीगेशन के साथ स्लाइडिंग विंडो दृष्टिकोण के माध्यम से स्थानीयकृत मेमोराइजेशन संकेतों का लाभ उठाकर फाइन-ट्यून्ड लार्ज लैंग्वेज मॉडल्स के विरुद्ध मौजूदा ग्लोबल-एवरेजिंग विधियों से काफी बेहतर प्रदर्शन करता है।

Yuetian Chen, Yuntao Du, Kaiyuan Zhang, Ashish Kundu, Charles Fleming, Bruno Ribeiro, Ninghui Li2026-03-09
💬 NLP

Creating a Hybrid Rule and Neural Network Based Semantic Tagger using Silver Standard Data: the PyMUSAS framework for Multilingual Semantic Annotation

यह शोध पत्र PyMUSAS फ्रेमवर्क प्रस्तुत करता है, जो पांच भाषाओं में USAS सिमेंटिक टैगिंग सिस्टम का सबसे बड़ा मूल्यांकन प्रस्तुत करता है और यह प्रदर्शित करता है कि कैसे एक नए निर्मित सिल्वर-स्टैंडर्ड डेटासेट पर प्रशिक्षित, नियम-आधारित विधियों और न्यूरल नेटवर्क को संयोजित करने वाला एक हाइब्रिड दृष्टिकोण, बहुभाषी सिमेंटिक एनोटेशन प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।

Andrew Moore, Paul Rayson, Dawn Archer, Tim Czerniak, Dawn Knight, Daisy Lal, Gearóid Ó Donnchadha, Mícheál Ó Meachair (…)2026-03-09
🤖 machine learning

Restoring Exploration after Post-Training: Latent Exploration Decoding for Large Reasoning Models

यह शोध पत्र लेटेंट एक्सप्लोरेशन डिकोडिंग (LED) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त डिकोडिंग रणनीति है जो पोस्ट-ट्रेन्ड लार्ज रीजनिंग मॉडल्स में एक्सप्लोरेशन कोलैप्स का मुकाबला करने के लिए हाई-एन्ट्रॉपी इंटरमीडिएट लेयर पोस्टीरियर्स का लाभ उठाती है, जिससे कई बेंचमार्क पर सटीकता में महत्वपूर्ण सुधार होता है।

Wenhui Tan, Fiorenzo Parascandolo, Enver Sangineto, Jianzhong Ju, Zhenbo Luo, Qian Cao, Rita Cucchiara, Ruihua Song, Jia (…)2026-03-09
🤖 AI

Accelerating Scientific Research with Gemini: Case Studies and Common Techniques

यह शोध पत्र केस स्टडीज का एक संग्रह प्रस्तुत करता है जो यह प्रदर्शित करता है कि कैसे शोधकर्ता सैद्धांतिक कंप्यूटर विज्ञान और अन्य क्षेत्रों में अनसुलझी समस्याओं को हल करने और नए प्रमाण उत्पन्न करने के लिए गूगल के जेमिनी (Gemini) मॉडल्स के साथ सफलतापूर्वक सहयोग करते हैं, और साथ ही वैज्ञानिक खोज में प्रभावी मानव-एआई साझेदारी के लिए सामान्य तकनीकों को निकालते हैं।

David P. Woodruff, Vincent Cohen-Addad, Lalit Jain, Jieming Mao, Song Zuo, MohammadHossein Bateni, Simina Branzei, Micha (…)2026-03-09