💬 NLP

Zero-Shot Stance Detection in the Wild: Dynamic Target Generation and Multi-Target Adaptation

यह शोध पत्र DGTA नामक एक नवीन ज़ीरो-शॉट स्टैंड्स डिटेक्शन कार्य प्रस्तावित करता है जो पूर्व ज्ञान के बिना कई गतिशील लक्ष्यों और उनके रुख (स्टेंस) की पहचान करता है, और यह प्रदर्शित करता है कि फाइन-ट्यून किए गए लार्ज लैंग्वेज मॉडल्स, विशेष रूप से दो-चरणीय और एकीकृत रणनीतियों के माध्यम से, एक नए निर्मित चीनी सोशल मीडिया डेटासेट पर बेहतर प्रदर्शन करते हैं।

Aohua Li, Yuanshuo Zhang, Ge Gao, Bo Chen, Xiaobing Zhao2026-02-03
💬 NLP

KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization

KAPSO एक मॉड्यूलर, ज्ञान-आधारित ढांचा है जो एक गिट-नेटिव (git-native) प्रयोग इंजन, एक संरचित ज्ञान प्रणाली और एक संज्ञानात्मक स्मृति परत को एकीकृत करके स्वायत्त प्रोग्राम संश्लेषण और अनुकूलन को बढ़ाता है, ताकि कोड आर्टिफैक्ट्स में सुधार किया जा सके और कोडिंग एजेंटों में होने वाली दीर्घकालिक विफलताओं को दूर किया जा सके।

Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani2026-02-03
💬 NLP

Shaping capabilities with token-level data filtering

यह शोध पत्र प्रदर्शित करता है कि प्रीट्रेनिंग डेटा को टोकन स्तर पर फ़िल्टर करना भाषा मॉडलों को प्रीट्रेनिंग के दौरान अवांछित क्षमताओं को हटाने के लिए आकार देने का एक स्केलेबल, सुदृढ़ और लागत प्रभावी तरीका है, जो डॉक्यूमेंट-स्तरीय फ़िल्टरिंग और पोस्ट हॉक अलाइनमेंट दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Neil Rathi, Alec Radford2026-02-03
💬 NLP

ChunkNorris: A High-Performance and Low-Energy Approach to PDF Parsing and Chunking

यह शोधपत्र ChunkNorris को प्रस्तुत करता है, जो PDF पार्सिंग और चंकिंग के लिए एक उच्च-प्रदर्शन, कम-ऊर्जा, ह्यूरिस्टिक-आधारित तकनीक है, जो मशीन लर्निंग पर निर्भर हुए बिना निष्पादन समय, ऊर्जा खपत और रिट्रीवल सटीकता में मौजूदा विधियों से बेहतर प्रदर्शन करती है।

Mathieu Ciancone, Clovis Varangot-Reille, Marion Schaeffer2026-02-03
💬 NLP

Chained Prompting for Better Systematic Review Search Strategies

यह शोध पत्र एक LLM-आधारित चेन्ड प्रॉम्प्टिंग फ्रेमवर्क पेश करता है जो व्यवस्थित समीक्षा खोज रणनीतियों के विकास को स्वचालित करने के लिए मैनुअल डिज़ाइन प्रक्रियाओं की नकल करता है, जिससे मौजूदा तरीकों की तुलना में बेहतर रिकॉल प्रदर्शन प्राप्त होता है और सुव्यवस्थित PICO तत्वों को उत्पन्न किया जाता है।

Fatima Nasser, Fouad Trad, Ammar Mohanna, Ghada El-Hajj Fuleihan, Ali Chehab2026-02-03
💬 NLP

PTCBENCH: Benchmarking Contextual Stability of Personality Traits in LLM Systems

यह शोध पत्र PTCBENCH प्रस्तुत करता है, जो एक व्यवस्थित बेंचमार्क है जो NEO फाइव-फैक्टर इन्वेंटरी का उपयोग करके विविध बाहरी परिदृश्यों में LLM व्यक्तित्वों की प्रासंगिक स्थिरता का मूल्यांकन करता है, जिससे यह पता चलता है कि विशिष्ट जीवन घटनाएँ व्यक्तित्व लक्षणों और तर्क क्षमताओं दोनों को महत्वपूर्ण रूप से बदल सकती हैं।

Jiongchi Yu, Yuhan Ma, Xiaoyu Zhang, Junjie Wang, Qiang Hu, Chao Shen, Xiaofei Xie2026-02-03
💬 NLP

SafeTalkCoach: Diversity-Driven Multi-Agent Simulation for Parent-Teen Health Conversations

SafeTalkCoach एक विविधता-संचालित मल्टी-एजेंट फ्रेमवर्क है जो वास्तविक दुनिया के डेटा की कमी को दूर करने और AI अनुसंधान एवं स्वास्थ्य संचार प्रथाओं दोनों को समर्थन देने के लिए यौन स्वास्थ्य के बारे में यथार्थवादी, उच्च-गुणवत्ता वाले और नियंत्रणीय सिम्युलेटेड माता-पिता और किशोर संवाद उत्पन्न करता है।

Benyamin Tabarsi, Wenbo Li, Tahreem Yasir, Aryan Santhosh Kumar, Laura Widman, Dongkuan Xu, Tiffany Barnes2026-02-03
💬 NLP

Extending Beacon to Hindi: Cultural Adaptation Drives Cross-Lingual Sycophancy

यह अध्ययन प्रदर्शित करता है कि बीकन (Beacon) चाटुकारिता निदान (sycophancy diagnostic) का हिंदी में विस्तार करने से सांस्कृतिक रूप से अनुकूलित प्रॉम्प्ट्स में अंग्रेजी की तुलना में काफी अधिक चाटुकारिता दर प्रकट होती है, जो यह संकेत देता है कि केवल भाषाई एन्कोडिंग के बजाय सांस्कृतिक ढांचा ही क्रॉस-लिंगुअल संरेखण विफलताओं का प्राथमिक चालक है।

Sarthak Sattigeri2026-02-03
💬 NLP

FoundationalASSIST: An Educational Dataset for Foundational Knowledge Tracing and Pedagogical Grounding of LLMs

यह शोध पत्र FoundationalASSIST को प्रस्तुत करता है, जो 1.7 मिलियन विस्तृत छात्र अंतःक्रियाओं और K-12 मानकों के साथ संरेखण वाला एक व्यापक शैक्षिक डेटासेट है, जो यह प्रकट करता है कि वर्तमान सीमावर्ती (फ्रंटियर) LLMs में व्यक्तिगत शिक्षण के लिए आवश्यक विश्वसनीय ज्ञान अनुरेखण (नॉलेज ट्रेसिंग) और शैक्षणिक तर्क की क्षमताओं की काफी कमी है।

Eamon Worden, Cristina Heffernan, Neil Heffernan, Shashank Sonkar2026-02-03
💬 NLP

SPARC-RAG: Adaptive Sequential-Parallel Scaling with Context Management for Retrieval-Augmented Generation

SPARC-RAG एक मल्टी-एजेंट फ्रेमवर्क है जो एकीकृत संदर्भ प्रबंधन (unified context management), लक्षित उप-प्रश्न पीढ़ी (targeted sub-query generation) और प्रक्रिया-स्तरीय फाइन-ट्यूनिंग के माध्यम से अनुक्रमिक और समानांतर अनुमान स्केलिंग (sequential and parallel inference scaling) को अनुकूल रूप से समन्वित करके जटिल मल्टी-हॉप प्रश्नों के लिए रिट्रीवल-ऑगमेंटेड जनरेशन को अनुकूलित करता है ताकि कम कम्प्यूटेशनल लागत के साथ बेहतर सटीकता प्राप्त की जा सके।

Yuxin Yang, Gangda Deng, Ömer Faruk Akgül, Nima Chitsazan, Yash Govilkar, Akasha Tigalappanavara, Shi-Xiong Zhang, Sambi (…)2026-02-03