💬 NLP

From Word Sequences to Behavioral Sequences: Adapting Modeling and Evaluation Paradigms for Longitudinal NLP

यह शोध पत्र एनएलपी (NLP) के लिए एक अनुदैर्ध्य मॉडलिंग और मूल्यांकन प्रतिमान प्रस्तावित करता है जो दस्तावेजों को स्वतंत्र नमूनों के बजाय समय-क्रमबद्ध व्यवहारिक अनुक्रमों के रूप में मानता है, और एक पीटीएसडी (PTSD) डायरी अध्ययन के माध्यम से यह प्रदर्शित करता है कि यह दृष्टिकोण पारिस्थितिक रूप से वैध अंतर्दृष्टि प्रदान करता है जो अक्सर पारंपरिक दस्तावेज़-स्तरीय विधियों द्वारा छूट जाती हैं या उलट दी जाती हैं।

Adithya V Ganesan, Vasudha Varadarajan, Oscar NE Kjell, Whitney R Ringwald, Scott Feltman, Benjamin J Luft, Roman Kotov (…)2026-06-30
💬 NLP

Preserving Fairness and Safety in Quantized LLMs Through Critical Weight Protection

यह शोध पत्र प्रकट करता है कि क्वांटाइजेशन (quantization) बड़े भाषा मॉडलों में निष्पक्षता और सुरक्षा को कम करता है, विशेष रूप से गैर-अंग्रेजी संदर्भों में, और बिना किसी महंगी पुनरप्रशिक्षण (retraining) की आवश्यकता के इन जोखिमों को कम करने के लिए एक नवीन "क्रिटिकल वेट प्रोटेक्शन" (Critical Weight Protection) तकनीक का प्रस्ताव करता है।

Muhammad Alif Al Hakim, Alfan Farizki Wicaksono, Fajri Koto2026-06-30
💬 NLP

The Effect of Scripts and Formats on LLM Numeracy

यह शोध पत्र प्रकट करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) कम प्रतिनिधित्व वाली लिपियों या प्रारूपों में संख्यात्मक अभिव्यक्तियों को संसाधित करते समय सटीकता में महत्वपूर्ण गिरावट का अनुभव करते हैं, लेकिन यह भी प्रदर्शित करता है कि लक्षित प्रॉम्प्टिंग रणनीतियाँ इस असमानता को प्रभावी ढंग से कम कर सकती हैं।

Varshini Reddy, Craig W. Schmidt, Seth Ebner, Adam Wiemerslage, Yuval Pinter, Chris Tanner2026-06-30
🧬 biology

A Large-Scale Dataset for Molecular Structure-Language Description via a Rule-Regularized Method

यह शोध पत्र एक पूर्णतः स्वचालित, नियम-नियमित ढांचे को प्रस्तुत करता है जो IUPAC नामों को संरचनात्मक XML मेटाडेटा में परिवर्तित करके 163,000 उच्च-परिशुद्धता वाले आणविक संरचना-भाषा युग्मों का एक बड़े पैमाने का डेटासेट उत्पन्न करता है ताकि LLMs को निर्देशित किया जा सके, जिससे मानव एनोटेशन की लागत संबंधी बाधाओं को दूर किया जा सके और डाउनस्ट्रीम रासायनिक कार्यों के लिए मजबूत अणु-भाषा संरेखण सक्षम किया जा सके।

Feiyang Cai, Guijuan He, Yi Hu, Jingjing Wang, Joshua Luo, Tianyu Zhu, Srikanth Pilla, Gang Li, Ling Liu, Feng Luo2026-06-30
💬 NLP

SPARKLING: Balancing Signal Preservation and Symmetry Breaking for Width-Progressive Learning

यह शोध पत्र SPARKLING को प्रस्तुत करता है, जो प्रोग्रेसिव लर्निंग में मिड-स्टेज विड्थ एक्सपेंशन (मध्य-चरण चौड़ाई विस्तार) के लिए एक नवीन फ्रेमवर्क है जो प्रशिक्षण अस्थिरता को दूर करने के लिए सिग्नल प्रिजर्वेशन (सिग्नल संरक्षण) और सिमिट्री ब्रेकिंग (सममिति भंग) के बीच संतुलन बनाता है, जिससे कंप्यूटेशनल लागत में 35% तक की कमी आती है और स्क्रैच से प्रशिक्षण की तुलना में बेहतर प्रदर्शन होता है।

Qifan Yu, Xinyu Ma, Zhijian Zhuo, Minrui Wang, Deyi Liu, Shiyi Zhan, Yiyuan Ma, Liang Xiang, Xingyan Bin, Di He2026-06-30
💬 NLP

Test-Time Detoxification without Training or Learning Anything

यह शोध पत्र एक प्रशिक्षण-मुक्त, टेस्ट-टाइम डिटॉक्सिफिकेशन विधि प्रस्तुत करता है जो इनपुट एम्बेडिंग्स पर ज़ीरो-ऑर्डर ऑप्टिमाइज़ेशन का उपयोग करके बड़े भाषा मॉडलों को बिना मॉडल रिट्रेनिंग, ग्रेडिएंट्स, या आंतरिक गणनाओं तक पहुँच के, कम विषाक्त आउटपुट की ओर निर्देशित करती है।

Baturay Saglam, Dionysis Kalogerias2026-06-30
💬 NLP

Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning

यह शोध पत्र एडेप्टिव सेफ कॉन्टेक्स्ट लर्निंग (ASCL) फ्रेमवर्क का प्रस्ताव करता है, जो सुरक्षा को एक मल्टी-टर्न टूल-यूज़ प्रक्रिया के रूप में स्वरूपित करके और तर्क क्षमताओं को संरक्षित करते हुए स्वायत्त नियम परामर्श को सक्षम करने के लिए इनवर्स फ्रीक्वेंसी पॉलिसी ऑप्टिमाइज़ेशन (IFPO) को पेश करके LLM अलाइनमेंट में सुरक्षा-उपयोगिता ट्रेड-ऑफ को कम करता है।

Yanbo Wang, Minzheng Wang, Jian Liang, Lu Wang, Yongcan Yu, Ran He2026-06-30
💬 NLP

SpecMind: Cognitively Inspired, Interactive Multi-Turn Framework for Postcondition Inference

यह शोधपत्र SpecMind प्रस्तुत करता है, जो एक संज्ञानात्मक रूप से प्रेरित, संवादात्मक मल्टी-टर्न फ्रेमवर्क है जो मौजूदा सिंगल-पास विधियों की तुलना में LLM-जनित पोस्टकंडीशन्स (postconditions) की सटीकता और पूर्णता में उल्लेखनीय सुधार करने के लिए फीडबैक-संचालित तर्क और स्वायत्त स्टॉपिंग क्राइटेरिया का लाभ उठाता है।

Cuong Chi Le, Minh V. T Pham, Tung Vu Duy, Cuong Duc Van, Huy N. Phan, Hoang N. Phan, Tien N. Nguyen2026-06-30
💬 NLP

The Digital Afterlife of Empires: Four Language Models Converge on the Same Imperial Cartography of Writing

यह शोध पत्र तर्क देता है कि साझा प्रशिक्षण डेटा के माध्यम से ऐतिहासिक साम्राज्यवादी असमानताएँ समकालीन लार्ज लैंग्वेज मॉडल्स में बनी हुई हैं, जिसके परिणामस्वरूप अधिकांश लेखन प्रणालियों के लिए अत्यधिक डिजिटल अल्प-समर्थन और विविध मॉडल आर्किटेक्चरों में व्यवस्थित, अभिसारी त्रुटियाँ होती हैं जो गैर-धार्मिक लिपियों को धार्मिक उपयोग के रूप में असमान रूप से गलत तरीके से आरोपित करती हैं।

Hiroki Fukui2026-06-30
💬 NLP

The Interference Gap: Comparing Retrieval Bounds in Human Memory and RAG Systems

यह शोध पत्र एक एकीकृत सिग्नल डिटेक्शन थ्योरी फ्रेमवर्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि मानव एपिसोडिक मेमोरी, मानक डेंस पैसेज रिट्रीवल सिस्टम की तुलना में सिमेंटिक इंटरफेरेंस के प्रति कम संवेदनशीलता प्रदर्शित करती है, जिसमें हिप्पोराग (HippoRAG) जैसे संज्ञानात्मक रूप से प्रेरित मॉडल प्रदर्शन के अंतर को पाटते हैं, जिससे मानव और एआई रिट्रीवल तंत्रों की तुलना करने के लिए एक नया सैद्धांतिक आधार प्राप्त होता है।

Dongxin Guo, Jikun Wu, Siu-Ming Yiu2026-06-30