💬 NLP

PoLoRA: A Preconditioned Orthogonalized LoRA Optimizer

PoLoRA एक नवीन ऑप्टिमाइज़र है जो लो-रैंक एडेप्टेशन (LoRA) के लिए उत्पाद-जागरूक स्पेक्ट्रल अपडेट (product-aware spectral updates), कर्वेचर प्रीकंडीशनिंग (curvature preconditioning), और एक मैग्नीट्यूड कंट्रोल रूल (magnitude control rule) को जोड़ता है ताकि मानक Adam की तुलना में तेज़ अभिसरण (convergence), लर्निंग रेट स्थिरता, और रैंक चयन के प्रति कम संवेदनशीलता प्राप्त की जा सके, जिसमें न्यूनतम कम्प्यूटेशनल ओवरहेड शामिल है।

Nikhil Ghosh, Tetiana Parshakova, Robert M. Gower2026-07-21
💬 NLP

It Matters How You Say It: Exploring Rhetorical Patterns for AI-Assisted Information Evaluation

यह शोध पत्र इस बात की जांच करता है कि एआई-सहायता प्राप्त तथ्य सत्यापन में आठ विशिष्ट अलंकारिक पैटर्न (rhetorical patterns) उपयोगकर्ता के प्रदर्शन और चिंतन को कैसे प्रभावित करते हैं, जिसमें यह पाया गया है कि जहाँ 'स्कैफोल्ड स्पष्टीकरण' (Scaffold Explanations) उच्चतम सटीकता लाभ प्रदान करते हैं, वहीं उपयोगकर्ता अन्य चिंतनशील शैलियों से जुड़े समय के खर्च के बावजूद आम तौर पर 'वैकल्पिक रूपरेखा' (Alternative Framing) को प्राथमिकता देते हैं।

Sadra Sabouri, Zeinabsadat Saghi, Jordan Lee Boyd-Graber, Jonathan May, Jonathan K. Kummerfeld, Souti Chattopadhyay2026-07-21
💬 NLP

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions

यह शोध पत्र ESCUCHA को प्रस्तुत करता है, जो कि पहला स्पेनिश स्पीच अंडरस्टैंडिंग बेंचमार्क है जिसमें बड़े ऑडियो लैंग्वेज मॉडल्स की रीजनिंग और ध्वनिक मजबूती (acoustic robustness) का कड़ाई से मूल्यांकन करने के लिए 162.9 घंटों के विविध, वास्तविक दुनिया के ऑडियो में 1,000 मानव-क्यूरेटेड प्रश्न शामिल हैं।

Fernando López, Ana Ayala, Guillermo Segovia, Fernando Ibáñez, Ana Martínez, Pablo Gómez, Jordi Luque2026-07-21
💬 NLP

When a Name Is Not a Name: A Benchmark Dataset and Distilled Reasoning for Culturally Entangled Bangla Homographs in Low-Resource LLMs

यह शोध पत्र उन बांग्ला होमोग्राफ्स (homographs) के लिए एक सांस्कृतिक रूप से आधारित बेंचमार्क प्रस्तुत करता है जो नाम और सामान्य संज्ञा दोनों के रूप में कार्य करते हैं, यह प्रदर्शित करते हुए कि जबकि मानक मॉडल एक प्रमुख-अर्थ पूर्वाग्रह (dominant-meaning bias) प्रदर्शित करते हैं, कंट्रास्टिव प्रॉम्प्टिंग (contrastive prompting) और सांस्कृतिक स्पष्टीकरणों का डिस्टिलिंग (distilling) कम-संसाधन वाले LLMs में तर्क प्रदर्शन को महत्वपूर्ण रूप से सुधार सकता है।

Md. Asaduzzaman Shuvo2026-07-21
💬 NLP

Zero Hallucination, by Construction: Hallucination-Aware Layered Oversight for Trustworthy Enterprise AI

यह शोध पत्र HALO (हैलुसिनेशन-अवेयर लेयर्ड ओवरसाइट) को प्रस्तुत करता है, जो एक छह-स्तरीय आश्वासन आर्किटेक्चर है जो बड़े भाषा मॉडलों की अंतर्निहित सीमाओं को समाप्त करके नहीं, बल्कि ग्राउंडेड जनरेशन, कंस्ट्रेंड एक्जीक्यूशन, मल्टी-सिग्नल वेरिफिकेशन, कैलिब्रेटेड एब्स्टेंशन, टोटल ट्रेसिबिलिटी और कंटीन्यूअस ओवरसाइट के एक सिस्टम-लेवल फ्रेमवर्क को लागू करके 'जीरो हैलुसिनेशन' प्राप्त करता है ताकि हैलुसिनेशन्स को एक प्रबंधनीय विफलता मोड के रूप में सीमित किया जा सके।

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu2026-07-21✓ Author reviewed
💬 NLP

Benchmarking Resource-Efficient LLMs for Research Topic Ontology Generation in the Biomedical Field

यह शोध पत्र प्रदर्शित करता है कि एक नए पेश किए गए बायोमेडिकल डेटासेट (MeSH-Rel-4K) पर छोटे, ओपन-सोर्स लार्ज लैंग्वेज मॉडल्स को फाइन-ट्यून करना प्रॉम्प्टिंग रणनीतियों की तुलना में काफी बेहतर प्रदर्शन करता है, जिससे F1-स्कोर में 34.1 प्रतिशत अंकों की वृद्धि होती है और स्वचालित बायोमेडिकल ऑन्टोलॉजी जनरेशन के लिए एक संसाधन-कुशल समाधान मिलता है।

Tanay Aggarwal, Angelo Salatino, Francesco Osborne, Enrico Motta2026-07-21
💬 NLP

MADA-RL: Multi-Agent Debate-Aware Reinforcement Learning for Parameter-Efficient Reasoning in Compact Models

MADA-RL एक पैरामीटर-कुशल पोस्ट-ट्रेनिंग फ्रेमवर्क है जो एक नवीन काउंटरफैक्चुअल क्रिटिक एडवांटेज के साथ मल्टी-एजेंट डिबेट मैकेनिज्म का उपयोग करके कॉम्पैक्ट लैंग्वेज मॉडल्स में रीजनिंग को बढ़ाता है ताकि LoRA के माध्यम से विशिष्ट जनरेटर और क्रिटिक एजेंटों को अनुकूलित किया जा सके, जिससे गणितीय बेंचमार्क पर सटीकता में उल्लेखनीय सुधार होता है और प्रशिक्षित पैरामीटर्स में भारी कमी आती है।

Martino M. L. Pulici, Cuong Xuan Chu, Evgeny Kharlamov, Zifeng Ding, Volker Tresp, Yunpu Ma2026-07-21
💬 NLP

Modeling turn-taking with distant viewing: investigating silence thresholds in human and AI-generated discourse

यह अध्ययन तीस अमेरिकी सिटकॉम और इक्यावन सिंथेटिक पॉडकास्ट में अंतराल की अवधि का विश्लेषण और तुलना करके, वक्ता के लिंग और उत्पादन परिवेश के आधार पर विविधताओं की जांच करते हुए, मानव और एआई-जनित विमर्श में मौन सीमाओं की जांच करता है।

Taylor Arnold, Nicolas Ballier, Artem Saloev2026-07-21
💬 NLP

WorldCupArena: Fine-Grained Evaluation of Language Models and Deep-Research Agents on Football Forecasting

यह शोधपत्र WorldCupArena को पेश करता है, जो फुटबॉल पूर्वानुमान के लिए भाषा मॉडल (language models) और डीप-रिसर्च एजेंटों का मूल्यांकन करने के लिए एक गतिशील बेंचमार्क है, जो मैचों के होने से पहले वास्तविक समय की जानकारी का उपयोग करके मैच के परिणामों, स्कोर और घटनाओं की भविष्यवाणी करने की उनकी क्षमता का परीक्षण करता है, जिसमें प्रारंभिक परिणाम सटीक सटीकता (exact accuracy) में सट्टेबाजी और मानव बेसलाइन की तुलना में मामूली बढ़त दिखाते हैं, लेकिन विस्तृत स्कोरलाइन भविष्यवाणियों में स्पष्ट सुधार दर्शाते हैं।

Zhaokai Wang, Tianlin Gui, Jiayuan Rao, Shangzhe Di, Yihong Tang, Dingli Liang2026-07-21
💬 NLP

VEHBench: A Stage-Local Diagnostic Benchmark for LLM-Assisted Vibration Energy Harvester Design

यह शोध पत्र VEHBench प्रस्तुत करता है, जो एक नवीन नैदानिक बेंचमार्क है जिसमें 763 साहित्य-आधारित कार्य शामिल हैं जो कंपन ऊर्जा हारवेस्टर (vibration energy harvester) डिजाइन के चार विशिष्ट चरणों में LLMs का मूल्यांकन करते हैं, जिससे यह पता चलता है कि मॉडल का प्रदर्शन अत्यधिक चरण-निर्भर है और इंजीनियरिंग AI के लिए एक वर्कफ़्लो-जागरूक दृष्टिकोण की आवश्यकता है।

Depeng Su, Yuyu Luo, Guobiao Hu2026-07-21