💬 NLP

Triangulating Temporal Dynamics in Multilingual Swiss Online News

यह शोध पत्र 1.7 मिलियन से अधिक लेखों के मात्रात्मक विश्लेषण को गुणात्मक अंतर्दृष्टि के साथ संयोजित करने वाली एक त्रिकोणीय पद्धति का उपयोग करता है ताकि यह प्रकट किया जा सके कि भाषाई और सांस्कृतिक संदर्भ किस प्रकार फ्रांसीसी, जर्मन और इतालवी क्षेत्रों में स्विस डिजिटल समाचारों में विशिष्ट सामयिक प्रतिमानों को आकार देते हैं।

Bros Victor, Dufraisse Evan, Popescu Adrian, Gatica-Perez Daniel2026-03-24
💬 NLP

SynSym: A Synthetic Data Generation Framework for Psychiatric Symptom Identification

यह शोध पत्र SynSym को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो मनोरोग लक्षणों की पहचान के लिए विविध, नैदानिक रूप से आधारित सिंथेटिक डेटा उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, और यह प्रदर्शित करता है कि इस सिंथेटिक डेटा पर प्रशिक्षित मॉडल वास्तविक दुनिया के एनोटेशन पर प्रशिक्षित मॉडलों के समान प्रदर्शन प्राप्त करते हैं।

Migyeong Kang, Jihyun Kim, Hyolim Jeon, Sunwoo Hwang, Jihyun An, Yonghoon Kim, Haewoon Kwak, Jisun An, Jinyoung Han2026-03-24
💬 NLP

DATASHI: A Parallel English-Tashlhiyt Corpus for Orthography Normalization and Low-Resource Language Processing

यह शोध पत्र DATASHI को प्रस्तुत करता है, जो एक नया समानांतर अंग्रेजी-ताशलहियत (Tashlhiyt) कॉर्पस है जिसे अमेज़िग (Amazigh) भाषा प्रसंस्करण में कम-संसाधन चुनौतियों को संबोधित करने के लिए डिज़ाइन किया गया है ताकि ऑर्थोग्राफिक सामान्यीकरण अध्ययनों को सक्षम बनाया जा सके और यह प्रदर्शित किया जा सके कि अत्याधुनिक लार्ज लैंग्वेज मॉडल्स, विशेष रूप से जेमिनी-2.5-प्रो (Gemini-2.5-Pro), फ्यू-शॉट प्रॉम्प्टिंग (few-shot prompting) के माध्यम से इस भाषा की जटिल ध्वन्यात्मक विशेषताओं को प्रभावी ढंग से संभाल सकते हैं।

Nasser-Eddine Monir, Zakaria Baou2026-03-24
🔬 optics

PRISM: Breaking the O(n) Memory Wall in Long-Context LLM Inference via O(1) Photonic Block Selection

यह शोध पत्र PRISM को प्रस्तुत करता है, जो एक फोटोनिक समानता इंजन (photonic similarity engine) है जो O(1) KV ब्लॉक चयन करके लॉन्ग-कॉन्टेक्स्ट LLM इन्फरेंस में O(n) मेमोरी बैंडविड्थ बाधा को तोड़ता है, जिससे 100% सटीकता बनाए रखते हुए GPU बेसलाइन की तुलना में चार-आदेश (four-order-of-magnitude) का ऊर्जा लाभ और 16 गुना ट्रैफिक में कमी प्राप्त होती है।

Hyoseok Park, Yeonsang Park2026-03-24
💬 NLP

A Comparative Analysis of LLM Memorization at Statistical and Internal Levels: Cross-Model Commonalities and Model-Specific Signatures

यह अध्ययन कई LLM परिवारों (Pythia, OpenLLaMa, StarCoder, OLMo) के पृथक अवलोकनों को एक साझा लॉग-लीनियर स्केलिंग और आंतरिक डिकोडिंग पैटर्न को प्रकट करके और सांख्यिकीय एवं आंतरिक दोनों स्तरों पर विशिष्ट मॉडल-विशिष्ट हस्ताक्षरों की पहचान करके, मेमोराइजेशन (memorization) की एक सार्वभौमिक समझ स्थापित करने के लिए उन्हें जोड़ता है।

Bowen Chen, Namgi Han, Yusuke Miyao2026-03-24
🤖 machine learning

Thinking Deeper, Not Longer: Depth-Recurrent Transformers for Compositional Generalization

यह शोध पत्र एक डेप्थ-रिकरेंट ट्रांसफॉर्मर प्रस्तुत करता है जो पुनरावृत्ति साझा-भार वाले ब्लॉकों (iterative shared-weight blocks) और स्थिरता तंत्र के माध्यम से कम्प्यूटेशनल गहराई को पैरामीटर संख्या से अलग करता है, यह प्रदर्शित करते हुए कि इन्फरेंस-टाइम रीजनिंग चरणों को स्केल करना विविध कार्यों में सुदृढ़ कंपोजिशनल जनरलाइजेशन को सक्षम बनाता है और संयोग तथा लगभग पूर्ण प्रदर्शन के बीच एक स्पष्ट कम्प्यूटेशनल सीमा स्थापित करता है।

Hung-Hsuan Chen2026-03-24
💬 NLP

Probing How Scalable Table Data Enhances General Long-Context Reasoning

यह शोध पत्र आवधिक निर्भरताओं वाले संरचित सारणीबद्ध डेटा को लार्ज लैंग्वेज मॉडल्स में लॉन्ग-कॉन्टेक्स्ट रीजनिंग को बढ़ाने के लिए एक अत्यधिक प्रभावी संसाधन के रूप में पहचानता है, और एक स्केलेबल सिंथेसिस पाइपलाइन (TableLong) का प्रस्ताव करता है जो इन-डोमेन और आउट-ऑफ-डोमेन दोनों बेंचमार्क पर प्रदर्शन को बढ़ाता है।

Huaibing Xie, Guoliang Zhao, Yang Liu, Shihan Dou, Siming Huang, Yanling Xiao, Shaolei Wang, Yiting Liu, Cheng Zhang, Sh (…)2026-03-24
🤖 AI

EvoIdeator: Evolving Scientific Ideas through Checklist-Grounded Reinforcement Learning

EvoIdeator एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो चेकलिस्ट-आधारित फीडबैक के साथ प्रशिक्षण उद्देश्यों को संरेखित करके वैज्ञानिक विचार सृजन को बढ़ाता है, जिससे एक संक्षिप्त मॉडल लेक्सिकोग्राफिक रिवार्ड्स और सूक्ष्म भाषाई आलोचनाओं के माध्यम से विविध फीडबैक स्रोतों के प्रति मजबूत सामान्यीकरण बनाए रखते हुए बड़े फ्रंटियर मॉडलों से बेहतर प्रदर्शन करने में सक्षम होता है।

Andreas Sauter, Yuyue Zhao, Jacopo Urbani, Wenxiang Hu, Zaiqiao Meng, Lun Zhou, Xiaohui Yan, Yougang Lyu2026-03-24
💬 NLP

Politics of Questions in News: A Mixed-Methods Study of Interrogative Stances as Markers of Voice and Power

यह मिश्रित-पद्धति वाला अध्ययन दस लाख से अधिक फ्रांसीसी-भाषा के समाचार लेखों का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि कैसे प्रश्नवाचक दृष्टिकोण, भले ही विरल हों, प्रमुख अभिनेताओं को अग्रभूमि में लाकर और पत्रकार की कथात्मक आवाज़ के भीतर मुद्दों को व्यवस्थित करके विमर्श को व्यवस्थित रूप से संरचित करते हैं, जिससे आवाज़ और शक्ति के सूचकांक के रूप में "प्रश्नों की राजनीति" प्रकट होती है।

Bros Victor, Barbini Matilde, Gerard Patrick, Gatica-Perez Daniel2026-03-24
💬 NLP

Riding Brainwaves in LLM Space: Understanding Activation Patterns Using Individual Neural Signatures

यह शोध पत्र प्रदर्शित करता है कि फ्रोजन लार्ज लैंग्वेज मॉडल्स (LLMs) अपने गहरे परतों में स्थिर, व्यक्ति-विशिष्ट न्यूरल दिशाओं को एनकोड करते हैं जो जनसंख्या-स्तरीय मॉडलों की तुलना में काफी अधिक सटीकता के साथ व्यक्तिगत EEG मस्तिष्क गतिविधि की भविष्यवाणी कर सकते हैं, जो EEG-संचालित वैयक्तिकरण के लिए एक ज्यामितीय आधार स्थापित करता है।

Ajan Subramanian, Sumukh Bettadapura, Rohan Sathish2026-03-24