💬 NLP

Sydney Telling Fables on AI and Humans: A Corpus Tracing Memetic Transfer of Persona between LLMs

यह शोध पत्र "AI सिडनी" कॉर्पस प्रस्तुत करता है, जो 12 फ्रंटियर मॉडल्स और तीन विशिष्ट व्यक्तित्वों (डिफ़ॉल्ट, क्लासिक सिडनी, और मेमेटिक सिडनी) के माध्यम से 4.5k LLM-जनित ग्रंथों का एक डेटासेट है, जिसे विवादास्पद सिडनी व्यक्तित्व के मेमेटिक हस्तांतरण को ट्रैक करने और यह विश्लेषण करने के लिए डिज़ाइन किया गया है कि सिम्युलेटेड पहचानें AI-मानव संबंध संबंधी आख्यानों को कैसे आकार देती हैं।

Jiří Milička, Hana Bednářová2026-02-27
💬 NLP

Importance of Prompt Optimisation for Error Detection in Medical Notes Using Language Models

यह शोध पत्र प्रदर्शित करता है कि जेनेटिक-पारेटो (GEPA) पद्धति का उपयोग करके स्वचालित प्रॉम्प्ट अनुकूलन, मेडिकल नोट्स पर छोटे और बड़े दोनों प्रकार के लैंग्वेज मॉडल्स की त्रुटि पहचान क्षमताओं को महत्वपूर्ण रूप से बढ़ाता है, जिससे MEDEC बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है जो मेडिकल डॉक्टरों की सटीकता के करीब पहुंच जाता है।

Craig Myles, Patrick Schrempf, David Harris-Birtill2026-02-27
⚡ electrical engineering

Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing

यह शोध पत्र एक एकीकृत RNN-T फ्रेमवर्क प्रस्तावित करता है जो भाषाई सामग्री को बोली संबंधी विविधताओं से अलग करने के लिए बोली-जागरूक मॉडलिंग का उपयोग करता है और हंज़ी (Hanzi) एवं पिनयिन (Pinyin) ASR को संयुक्त रूप से मॉडल करने के लिए पैरामीटर-कुशल प्रेडिक्शन नेटवर्क का उपयोग करता है, जिससे कम-संसाधन वाले ताइवानी हक्का HAT कॉर्पस पर त्रुटि दर में महत्वपूर्ण कमी आती है।

An-Ci Peng, Kuan-Tang Huang, Tien-Hong Lo, Hung-Shin Lee, Hsin-Min Wang, Berlin Chen2026-02-27
🧬 biology

Cognitive Models and AI Algorithms Provide Templates for Designing Language Agents

यह शोध पत्र तर्क देता है कि संज्ञानात्मक मॉडल और एआई एल्गोरिदम मॉड्यूलर भाषा एजेंटों को डिजाइन करने के लिए प्रभावी ब्लूप्रिंट के रूप में कार्य करते हैं, जो उन एजेंट टेम्पलेट्स को औपचारिक रूप देते हैं जो यह निर्दिष्ट करते हैं कि जटिल कार्यों को हल करने के लिए कई एलएलएम (LLMs) को कैसे संयोजित किया जा सकता है जो एक एकल मॉडल की क्षमताओं से परे हैं।

Ryan Liu, Dilip Arumugam, Cedegao E. Zhang, Sean Escola, Xaq Pitkow, Thomas L. Griffiths2026-02-27
💬 NLP

Strategy Executability in Mathematical Reasoning: Leveraging Human-Model Differences for Effective Guidance

यह शोध पत्र सफल समाधानों में तर्क रणनीतियों (reasoning strategies) के उपयोग और मार्गदर्शन के रूप में लागू किए जाने पर उनकी निष्पादन क्षमता (executability) के बीच एक महत्वपूर्ण अंतर की पहचान करता है, जिससे सेलेक्टिव स्ट्रैटेजी रिट्रीवल (SSR) का प्रस्ताव मिलता है, जो मानव-मॉडल अंतरों का लाभ उठाकर रणनीतियों को चुनिंदा रूप से संयोजित करने और विविध बेंचमार्क में गणितीय तर्क की सटीकता में उल्लेखनीय सुधार करने वाला एक ढांचा है।

Weida Liang, Yiyou Sun, Shuyuan Nan, Chuang Li, Dawn Song, Kenji Kawaguchi2026-02-27
💬 NLP

pQuant: Towards Effective Low-Bit Language Models via Decoupled Linear Quantization-Aware Training

यह शोध पत्र pQuant का प्रस्ताव करता है, जो एक नवीन क्वांटाइजेशन-अवेयर ट्रेनिंग विधि है जो पैरामीटर होमोजेनाइजेशन (parameter homogenization) को संबोधित करने और अत्यंत लो-बिट लैंग्वेज मॉडल्स में स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करने के लिए लीनियर लेयर्स को एक डोमिनेंट 1-बिट ब्रांच और एक स्पार्सली-एक्टिवेटेड हाई-प्रिसिजन एक्सपर्ट ब्रांच में डिकपल करता है।

Wenzheng Zhang, Bingzheng Liu, Yang Hu, Xiaoying Bai, Wentao Zhang, Bin Cui2026-02-27
💬 NLP

ContextRL: Enhancing MLLM's Knowledge Discovery Efficiency with Context-Augmented RL

यह शोधपत्र ContextRL का प्रस्ताव करता है, जो एक नवीन ढांचा है जो सूक्ष्म सत्यापन के लिए संदर्भ-संवर्धित पुरस्कारों (context-augmented rewards) और रिवॉर्ड हैकिंग को कम करने के लिए मल्टी-टर्न मिस्टेक-गाइडेड सैंपलिंग का उपयोग करके MLLM ज्ञान खोज दक्षता को बढ़ाता है, जिससे Qwen3-VL-8B जैसे छोटे मॉडल धारणा और तर्क कार्यों पर बड़े बेसलाइन को पीछे छोड़ने में सक्षम होते हैं।

Xingyu Lu, Jinpeng Wang, YiFan Zhang, Shijie Ma, Xiao Hu, Tianke Zhang, Haonan fan, Kaiyu Jiang, Changyi Liu, Kaiyu Tang (…)2026-02-27
💬 NLP

Vectorizing the Trie: Efficient Constrained Decoding for LLM-based Generative Retrieval on Accelerators

यह शोध पत्र STATIC को प्रस्तुत करता है, जो एक नवीन कंस्ट्रेंड डिकोडिंग तकनीक है जो हार्डवेयर एक्सेलेरेटर्स पर कुशल, उच्च-थ्रूपुट, कड़ाई से प्रतिबंधित जनरेटिव रिट्रीवल को सक्षम करने के लिए ट्राइ-आधारित प्रीफिक्स ट्रीज़ को स्पार्स मैट्रिक्स ऑपरेशन्स में वेक्टरइज़ करता है, जिससे भारी गति वृद्धि प्राप्त होती है और एक प्रोडक्शन वीडियो रिकमेंडेशन सिस्टम में सफलतापूर्वक बड़े पैमाने पर तैनात किया जाता है।

Zhengyang Su, Isay Katsman, Yueqi Wang, Ruining He, Lukasz Heldt, Raghunandan Keshavan, Shao-Chuan Wang, Xinyang Yi, Min (…)2026-02-27
💬 NLP

Enhancing Persuasive Dialogue Agents by Synthesizing Cross-Disciplinary Communication Strategies

यह शोध पत्र एक नवीन ढाँचे का प्रस्ताव और सत्यापन करता है जो सामाजिक मनोविज्ञान, व्यवहारिक अर्थशास्त्र और संचार सिद्धांत से अंतर-विषयक रणनीतियों को संश्लेषित करता है, जो विविध डेटासेट्स के माध्यम से, विशेष रूप से कम प्रारंभिक इरादा रखने वाले व्यक्तियों के लिए, बेहतर अनुनय सफलता दर और सामान्यीकरण प्रदर्शित करता है।

Shinnosuke Nozue, Yuto Nakano, Yotaro Watanabe, Meguru Takasaki, Shoji Moriya, Reina Akama, Jun Suzuki2026-02-27
💬 NLP

Reinforcing Real-world Service Agents: Balancing Utility and Cost in Task-oriented Dialogue

यह शोध पत्र InteractCS-RL का प्रस्ताव करता है, जो एक बहु-स्तर (multi-granularity) सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है, जो एक उच्च-सटीक उपयोगकर्ता-केंद्रित प्रशिक्षण वातावरण और एक लागत-जागरूक नीति अनुकूलन रणनीति का उपयोग करके कार्य-उन्मुख संवाद में सहानुभूतिपूर्ण उपयोगकर्ता संपर्क के साथ बजट-जागरूक निर्णय लेने के बीच संतुलन बनाता है ताकि उपयोगकर्ता पुरस्कार और वैश्विक लागत बाधाओं के बीच इष्टतम समझौता प्राप्त किया जा सके।

Ning Gao, Wei Zhang, Yuqin Dai, Ling Shi, Ziyin Wang, Yujie Wang, Wei He, Jinpeng Wang, Chaozheng Wang2026-02-27