💬 NLP

From Chaos to Clarity: Schema-Constrained AI for Auditable Biomedical Evidence Extraction from Full-Text PDFs

यह शोध पत्र एक स्कीमा-प्रतिबंधित (schema-constrained) एआई प्रणाली प्रस्तुत करता है जो साक्ष्य संश्लेषण (evidence synthesis) में मौजूदा दस्तावेज़ एआई की स्केलेबिलिटी और विश्वसनीयता की सीमाओं को दूर करने के लिए टाइप किए गए स्कीमा, प्रोवेनेंस ट्रैकिंग और संघर्ष-जागरूक समेकन (conflict-aware consolidation) का उपयोग करते हुए पूर्ण-पाठ बायोमेडिकल पीडीएफ को संरचित, ऑडिट योग्य साक्ष्य रिकॉर्ड में परिवर्तित करती है।

Pouria Mortezaagha, Joseph Shaw, Bowen Sun, Arya Rahgozar2026-01-22
💬 NLP

Developmental trajectories of decision making and affective dynamics in large language models

यह अध्ययन प्रकट करता है कि जहाँ नए बड़े भाषा मॉडल निर्णय लेने में तेजी से मानव-समान जोखिम लेने और दृष्टिकोण-परिहार (approach-avoidance) के पैटर्न प्रदर्शित करते हैं, वहीं वे साथ ही साथ कम हानि-विमुखता (loss aversion), नियतात्मक विकल्पों और निरंतर उच्च आधारभूत मनोदशा जैसे विशिष्ट गैर-मानवीय गुणों को भी विकसित करते हैं, जो उच्च-जोखिम वाले नैदानिक परिवेशों में उनके नैतिक परिनियोजन के लिए महत्वपूर्ण निहितार्थों को रेखांकित करते हैं।

Zhihao Wang, Yiyang Liu, Ting Wang, Zhiyuan Liu2026-01-22
💬 NLP

The Slow Drift of Support: Boundary Failures in Multi-Turn Mental Health LLM Dialogues

यह शोध पत्र प्रकट करता है कि जहाँ एकल-चरण (single-turn) सुरक्षा परीक्षण मानसिक स्वास्थ्य संबंधी LLMs में सीमाओं के क्रमिक क्षरण को पकड़ने में विफल रहते हैं, वहीं बहु-चरण (multi-turn) स्ट्रेस टेस्टिंग यह प्रदर्शित करती है कि मॉडल विस्तारित संवादों के दौरान निश्चित वादे करके बार-बार सुरक्षा सीमाओं का उल्लंघन करते हैं, जिसमें एडेप्टिव प्रोबिंग (adaptive probing), स्थिर प्रगति (static progression) की तुलना में इन उल्लंघनों को तेज कर देती है।

Youyou Cheng, Zhuangwei Kang, Kerry Jiang, Chenyu Sun, Qiyang Pan2026-01-22
💬 NLP

Opening the Black Box: A Survey on the Mechanisms of Multi-Step Reasoning in Large Language Models

यह सर्वेक्षण सात परस्पर जुड़े हुए प्रश्नों के एक वैचारिक ढांचे के इर्द-गिर्द मौजूदा शोध को व्यवस्थित करके, लार्ज लैंग्वेज मॉडल्स में बहु-चरणीय तर्क (multi-step reasoning) के अंतर्निहित आंतरिक तंत्रों का एक व्यापक अवलोकन प्रदान करता है और यांत्रिक अध्ययनों (mechanistic studies) के लिए पांच भविष्य की दिशाओं को रेखांकित करता है।

Liangming Pan, Jason Liang, Jiaran Ye, Minglai Yang, Xinyuan Lu, Fengbin Zhu2026-01-22
💬 NLP

Prosody-Guided Harmonic Attention for Phase-Coherent Neural Vocoding in the Complex Spectrum

यह शोधपत्र एक नवीन न्यूरल वोकोडर (neural vocoder) प्रस्तावित करता है जो प्रोसोडी-गाइडेड हार्मोनिक अटेंशन (prosody-guided harmonic attention) और डायरेक्ट कॉम्प्लेक्स स्पेक्ट्रम मॉडलिंग (direct complex spectrum modeling) का लाभ उठाकर मौजूदा अत्याधुनिक तरीकों की तुलना में प्रोसोडी को बढ़ाने, फेज़ कोहेरेंस (phase coherence) सुनिश्चित करने और पिच फिडेलिटी (pitch fidelity) एवं बोधगम्य गुणवत्ता में महत्वपूर्ण सुधार करने के लिए प्रोसोडी को बढ़ाता है।

Mohammed Salah Al-Radhi, Riad Larbi, Mátyás Bartalis, Géza Németh2026-01-22
💬 NLP

Large Language Models for Large-Scale, Rigorous Qualitative Analysis in Applied Health Services Research

यह शोध पत्र गुणात्मक स्वास्थ्य-सेवा अनुसंधान में लार्ज लैंग्वेज मॉडल्स (LLMs) को एकीकृत करने के लिए एक मॉडल- और कार्य-अज्ञेय (model- and task-agnostic) ढांचे को प्रस्तुत करता है, जो एक बहु-केंद्र मधुमेह अध्ययन के माध्यम से यह प्रदर्शित करता है कि कैसे मानव-LLM सहयोग अभ्यास और सिद्धांत को सूचित करने के लिए बड़े पैमाने पर साक्षात्कार डेटा के विश्लेषण की दक्षता और कठोरता को बढ़ा सकता है।

Sasha Ronaghi, Emma-Louise Aveling, Maria Levis, Rachel Lauren Ross, Emily Alsentzer, Sara Singer2026-01-22
💬 NLP

Business Logic-Driven Text-to-SQL Data Synthesis for Business Intelligence

यह शोध पत्र एक बिजनेस लॉजिक-ड्रिवन डेटा सिंथेसिस फ्रेमवर्क प्रस्तावित करता है जो निजी बिजनेस इंटेलिजेंस परिवेशों के लिए अत्यधिक यथार्थवादी, वर्कफ़्लो-आधारित टेक्स्ट-टू-एसक्यूएल (Text-to-SQL) मूल्यांकन डेटा उत्पन्न करता है, जो मौजूदा विधियों की तुलना में बेहतर यथार्थवाद और संरेखण प्रदर्शित करता है और साथ ही वर्तमान अत्याधुनिक मॉडलों में महत्वपूर्ण प्रदर्शन अंतराल को उजागर करता है।

Jinhui Liu, Ximeng Zhang, Yanbo Ai, Zhou Yu2026-01-22
💬 NLP

Towards Execution-Grounded Automated AI Research

यह शोध पत्र एक स्वचालित निष्पादन ढांचे (automated execution framework) को प्रस्तुत करता है जो बड़े पैमाने पर समानांतर GPU प्रयोगों के माध्यम से LLM-जनित अनुसंधान विचारों को सत्यापित और परिष्कृत करता है, यह प्रदर्शित करते हुए कि निष्पादन-निर्देशित विकासवादी खोज (execution-guided evolutionary search) प्रभावी रूप से बेहतर प्री-ट्रेनिंग और पोस्ट-ट्रेनिंग विधियों की खोज करती है और इस संदर्भ में सुदृढीकरण शिक्षण (reinforcement learning) की सीमाओं और फ्रंटियर LLMs के शीघ्र संतृप्ति (early saturation) को प्रकट करती है।

Chenglei Si, Zitong Yang, Yejin Choi, Emmanuel Candès, Diyi Yang, Tatsunori Hashimoto2026-01-22
💬 NLP

Self-Blinding and Counterfactual Self-Simulation Mitigate Biases and Sycophancy in Large Language Models

यह शोध पत्र यह प्रदर्शित करता है कि जहाँ बड़े भाषा मॉडल पूर्वाग्रहों और चापलूसी को कम करने के लिए काउंटरफैक्चुअल सेल्फ-सिमुलेशन (counterfactual self-simulation) में संघर्ष करते हैं, वहीं मनुष्यों के विपरीत, वे एक "सेल्फ-ब्लाइंडेड" (self-blinded) प्रतिरूप से ग्राउंड-ट्रुथ प्रतिक्रियाओं तक पहुँचने के लिए अपने API का लाभ उठाकर अधिक निष्पक्ष निर्णय और अधिक पारदर्शिता प्राप्त कर सकते हैं।

Brian Christian, Matan Mazor2026-01-22
💬 NLP

AdaTIR: Adaptive Tool-Integrated Reasoning via Difficulty-Aware Policy Optimization

AdaTIR एक ऐसा फ्रेमवर्क है जो डिफिकल्टी-अवेयर पॉलिसी ऑप्टिमाइज़ेशन और क्लिप्ड एडवांटेज शेपिंगिंग का उपयोग करके लार्ज लैंग्वेज मॉडल एजेंटों को उन्नत करता है ताकि वे सरल कार्यों के लिए गतिशील रूप से तर्क को आंतरिक रूप से आत्मसात कर सकें और जटिल कार्यों के लिए चुनिंदा रूप से टूल्स का आह्वान कर सकें, जिससे सटीकता से समझौता किए बिना अनावश्यक टूल कॉल्स को काफी हद तक कम किया जा सके।

Zhaiyu Fang, Ruipeng Sun2026-01-22