🧬 biology

Characterizing Human Semantic Navigation in Concept Production as Trajectories in Embedding Space

यह शोध पत्र एक ऐसे ढांचे को प्रस्तुत करता है जो मानव अवधारणा उत्पादन को एम्बेडिंग स्पेस के भीतर नेविगेशन प्रक्षेप पथों के रूप में मॉडल करता है, जो कई भाषाओं में नैदानिक समूहों और अवधारणा प्रकारों के बीच अंतर करने के लिए ज्यामितीय और गतिशील मेट्रिक्स का उपयोग करता है और पारंपरिक भाषाई विश्लेषण के एक गणनात्मक रूप से कुशल विकल्प की पेशकश करता है।

Felipe D. Toro-Hernández, Jesuino Vieira Filho, Rodrigo M. Cabral-Carvalho2026-04-15
🤖 AI

GoodPoint: Learning Constructive Scientific Paper Feedback from Author Responses

यह शोध पत्र गुडपॉइंट (GoodPoint) का परिचय देता है, जो एक ऐसा प्रशिक्षण ढांचा है जो वैध और कार्रवाई योग्य फीडबैक के डेटासेट को क्यूरेट करने के लिए लेखकों की प्रतिक्रियाओं का लाभ उठाता है, जिससे एक फाइन-ट्यून्ड एलएलएम (LLM) वैज्ञानिक शोध पत्रों के लिए रचनात्मक फीडबैक उत्पन्न करने में मौजूदा मॉडलों से काफी बेहतर प्रदर्शन करने में सक्षम होता है जिसे लेखक व्यावहारिक रूप से मूल्यवान पाते हैं।

Jimin Mun, Chani Jung, Xuhui Zhou, Hyunwoo Kim, Maarten Sap2026-04-15
💬 NLP

AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection

यह शोध पत्र AnyPoC को प्रस्तुत करता है, जो एक स्केलेबल मल्टी-एजेंट फ्रेमवर्क है जो संभावित बग रिपोर्टों के लिए स्वचालित रूप से निष्पादन योग्य प्रूफ-ऑफ-कॉन्सेप्ट परीक्षण उत्पन्न करता है और उनका कड़ाई से सत्यापन करता है, जिससे फॉल्स पॉजिटिव्स में काफी कमी आती है और 12 प्रमुख सॉफ्टवेयर सिस्टम में 120 से अधिक नए बगों की सफलतापूर्वक खोज की जाती है।

Zijie Zhao, Chenyuan Yang, Weidong Wang, Yihan Yang, Ziqi Zhang, Lingming Zhang2026-04-15
💬 NLP

INDOTABVQA: A Benchmark for Cross-Lingual Table Understanding in Bahasa Indonesia Documents

यह शोध पत्र INDOTABVQA प्रस्तुत करता है, जो बहासा इंडोनेशिया दस्तावेज़ों में टेबल विजुअल क्वेश्चन अनस्विंग (Table Visual Question Answering) के लिए एक क्रॉस-लिंगुअल बेंचमार्क डेटासेट है, जो लक्षित फाइन-ट्यूनिंग और स्थानिक पूर्ववृत्तों (spatial priors) के समावेश के माध्यम से विजन-लैंग्वेज मॉडल्स के लिए महत्वपूर्ण प्रदर्शन लाभों का मूल्यांकन और प्रदर्शन करता है।

Somraj Gautam, Anathapindika Dravichi, Gaurav Harit2026-04-15
💬 NLP

Filtered Reasoning Score: Evaluating Reasoning Quality on a Model's Most-Confident Traces

यह शोध पत्र फ़िल्टर्ड रीजनिंग स्कोर (FRS) प्रस्तुत करता है, जो एक नया मूल्यांकन मीट्रिक है जो एक LLM के रीजनिंग ट्रेसेस (तर्क पथों) की गुणवत्ता का आकलन करने के लिए उसके सबसे आत्मविश्वासी आउटपुट पर ध्यान केंद्रित करता है, जिससे समान सटीकता वाले लेकिन भिन्न तर्क क्षमताओं वाले मॉडलों के बीच अंतर किया जा सके और हस्तांतरणीय तर्क कौशल के साथ मजबूत सहसंबंध प्रदर्शित किया जा सके।

Manas Pathak, Xingyao Chen, Shuozhe Li, Amy Zhang, Liu Leqi2026-04-15
💬 NLP

Self-Distillation Zero: Self-Revision Turns Binary Rewards into Dense Supervision

यह शोध पत्र सेल्फ-डिस्टिलेशन ज़ीरो (SD-Zero) का प्रस्ताव करता है, जो एक प्रशिक्षण विधि है जो एक ही मॉडल को जनरेटर और रिवाइज़र दोनों के रूप में कार्य कराकर विरल बाइनरी रिवॉर्ड्स को सघन टोकन-स्तरीय पर्यवेक्षण में परिवर्तित करती है, जिससे बिना किसी बाहरी शिक्षक या उच्च गुणवत्ता वाले प्रदर्शनों की आवश्यकता के रीजनिंग बेंचमार्क पर उत्कृष्ट प्रदर्शन प्राप्त किया जा सके।

Yinghui He, Simran Kaur, Adithya Bhaskar, Yongjin Yang, Jiarui Liu, Narutatsu Ri, Liam Fowl, Abhishek Panigrahi, Danqi C (…)2026-04-15
💬 NLP

LLMs Struggle with Abstract Meaning Comprehension More Than Expected

यह शोध पत्र प्रकट करता है कि अपनी सामान्य क्षमताओं के बावजूद, बड़े भाषा मॉडल फाइन-ट्यून किए गए मॉडलों की तुलना में अमूर्त अर्थ बोध (abstract meaning comprehension) के साथ महत्वपूर्ण रूप से संघर्ष करते हैं, लेकिन एक मानव संज्ञान से प्रेरित द्वि-दिशीय ध्यान क्लासिफायर (bidirectional attention classifier) का प्रस्ताव देता है जो SemEval-2021 टास्क 4 (ReCAM) बेंचमार्क पर फाइन-ट्यून किए गए मॉडलों के प्रदर्शन को सफलतापूर्वक बढ़ाता है।

Hamoud Alhazmi, Jiachen Jiang2026-04-15
💬 NLP

Think Through Uncertainty: Improving Long-Form Generation Factuality via Reasoning Calibration

यह शोध पत्र CURE को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो एक संरचित तर्क प्रोटोकॉल और बहु-चरणीय अंशांकन (कैलिब्रेशन) के माध्यम से बड़े भाषा मॉडलों को व्यक्तिगत दावे के स्तर पर आत्मविश्वास का अनुमान लगाने के लिए प्रशिक्षित करके दीर्घ-रूप पीढ़ी की तथ्यात्मकता को बढ़ाता है, जिससे अधिक सटीक चयनात्मक भविष्यवाणी सक्षम होती है और मतिभ्रम (हैलुसिनेशन) को काफी कम किया जाता है।

Xin Liu, Lu Wang2026-04-15
💬 NLP

Empirical Evaluation of PDF Parsing and Chunking for Financial Question Answering with RAG

यह शोध पत्र वित्तीय प्रश्नोत्तर के लिए रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) प्रणालियों के भीतर विभिन्न PDF पार्सर और चंकिंग रणनीतियों का मूल्यांकन करने वाला एक अनुभवजन्य अध्ययन प्रस्तुत करता है, जो मजबूत दस्तावेज़ समझ पाइपलाइन बनाने के लिए व्यावहारिक दिशा-निर्देश प्रदान करने हेतु 'टेबलक्वेस्ट' (TableQuest) नामक एक नया बेंचमार्क पेश करता है।

Omar El Bachyr, Yewei Song, Saad Ezzini, Jacques Klein, Tegawendé F. Bissyandé, Anas Zilali, Ulrick Ble, Anne Goujon2026-04-15
💬 NLP

LoSA: Locality Aware Sparse Attention for Block-Wise Diffusion Language Models

यह शोध पत्र LoSA का प्रस्ताव करता है, जो एक लोकैलिटी-अवेयर (locality-aware) स्पार्स अटेंशन मैकेनिज्म है जो स्थिर टोकन के लिए कैश किए गए अटेंशन परिणामों का पुन: उपयोग करके और केवल सक्रिय टोकन पर स्पार्स अटेंशन लागू करके ब्लॉक-वाइज़ डिफ्यूजन लैंग्वेज मॉडल्स को त्वरित करता है, जिससे KV इन्फ्लेशन (KV inflation) पर काबू पाकर लॉन्ग-कॉन्टेक्स्ट परिदृश्यों में महत्वपूर्ण गति और बेहतर सटीकता प्राप्त की जा सकती है।

Haocheng Xi, Harman Singh, Yuezhou Hu, Coleman Hooper, Rishabh Tiwari, Aditya Tomar, Minjae Lee, Wonjun Kang, Michael Ma (…)2026-04-15