💬 NLP

Privacy-Aware Visual Language Models

यह शोध पत्र उच्च गुणवत्ता वाले बेंचमार्क (PrivBench और PrivBench-H) और एक इंस्ट्रक्शन-ट्यूनिंग डेटासेट (PrivTune) को पेश करते हुए गोपनीयता-संवेदनशील सामग्री को संभालने में विजुअल लैंग्वेज मॉडल्स की सीमाओं को संबोधित करता है, और यह प्रदर्शित करता है कि न्यूनतम डेटा पर फाइन-ट्यूनिंग करने से समग्र प्रदर्शन को बनाए रखते हुए गोपनीयता जागरूकता में उल्लेखनीय वृद्धि होती है।

Laurens Samson, Nimrod Barazani, Sennay Ghebreab, Yuki M. Asano2026-06-25
💬 NLP

Hengqin-RA-v1: Advanced Large Language Model for Diagnosis and Treatment of Rheumatoid Arthritis with Dataset based Traditional Chinese Medicine

यह शोध पत्र Hengqin-RA-v1 को प्रस्तुत करता है, जो पारंपरिक चीनी चिकित्सा के लिए एक विशिष्ट लार्ज लैंग्वेज मॉडल है, जो निदान और उपचार की सटीकता में सामान्य-उद्देश्य वाले मॉडलों और यहाँ तक कि मानव चिकित्सकों से भी बेहतर प्रदर्शन करने के लिए एक नए क्यूरेटेड रुमेटॉइड अर्थराइटिस डेटासेट का लाभ उठाता है।

Yishen Liu2026-06-25
💬 NLP

A Systematic Analysis of Hybrid Linear Attention

यह शोध पत्र व्यवस्थित रूप से 72 हाइब्रिड लीनियर अटेंशन मॉडलों का मूल्यांकन करता है यह निर्धारित करने के लिए कि जबकि स्टैंडअलोन लीनियर प्रदर्शन हाइब्रिड सफलता की गारंटी नहीं देता है, HGRN-2 या GatedDeltaNet जैसी आर्किटेक्चर जो 3:1 से 6:1 के लीनियर-टू-फुल अटेंशन अनुपात का उपयोग करती हैं, चयनात्मक गेटिंग (selective gating), पदानुक्रमित पुनरावृत्ति (hierarchical recurrence) और नियंत्रित विस्मृति (controlled forgetting) का लाभ उठाकर कुशलतापूर्वक ट्रांसफॉर्मर-स्तर की रिकॉल प्राप्त करती हैं।

Dustin Wang, Rui-Jie Zhu, Steven Abreu, Yong Shan, Taylor Kergan, Yuqi Pan, Yuhong Chou, Zheng Li, Jibin Wu, Ge Zhang, W (…)2026-06-25
💬 NLP

Scale or Reason? A Compute-Equivalent Analysis of Reasoning Distillation

यह शोध पत्र प्रदर्शित करता है कि, एक निश्चित कंप्यूट बजट के तहत, मानक इंस्ट्रक्शन फाइन-ट्यूनिंग (instruction fine-tuning) अधिकांश मॉडल स्केल्स और कार्यों में रीजनिंग डिस्टिलेशन (reasoning distillation) से बेहतर प्रदर्शन करती है या उसके बराबर रहती है, जबकि बाद वाला केवल बड़े मॉडलों के लिए ओपन-एंडेड समस्याओं पर तभी फायदेमंद होता है जब इसे 25-50% रीजनिंग डेटा के लागत प्रभावी करिकुलम मिक्सिंग (curriculum mixing) के साथ जोड़ा जाए।

Nicolas Boizard, Hippolyte Gisserot-Boukhlef, Kevin El Haddad, Céline Hudelot, Pierre Colombo2026-06-25
⚡ electrical engineering

Robustness assessment of large audio language models in multiple-choice evaluation

यह शोध पत्र प्रकट करता है कि बड़े ऑडियो भाषा मॉडल बहुविकल्पीय मूल्यांकनों में विकल्प क्रम और पैराफ्रेसिंग (वाक्य पुनर्गठन) के प्रति महत्वपूर्ण संवेदनशीलता प्रदर्शित करते हैं, जिसके कारण लेखक तीन बेंचमार्क और चार मॉडलों में इन विविधताओं को संबोधित करने के लिए एक अधिक सुदृढ़ मूल्यांकन प्रोटोकॉल और मीट्रिक का प्रस्ताव करते हैं।

Fernando López, Santosh Kesiraju, Jordi Luque2026-06-25
💬 NLP

How Pragmatics Shape Articulation: A Computational Case Study in STEM ASL Discourse

यह अध्ययन अमेरिकन साइन लैंग्वेज (ASL) STEM संवादों के एक मोशन कैप्चर डेटासेट को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि प्रैग्मैटिक इंटरैक्शन (व्यावहारिक अंतःक्रियाएं), आइसोलेटेड (विलग) या मोनोलॉग संदर्भों की तुलना में साइन की अवधि को महत्वपूर्ण रूप से कम करती हैं और स्पैटियोटेम्पोरल एंट्रेनमेंट (स्थानिक-कालिक तालमेल) उत्पन्न करती हैं, जिससे साइन लैंग्वेज प्रौद्योगिकियों के लिए गतिशील संवादात्मक परिवर्तनशीलता को ध्यान में रखने की आवश्यकता पर बल मिलता है।

Saki Imai, Lee Kezar, Laurel Aichler, Mert Inan, Erin Walker, Alicia Wooten, Lorna Quandt, Malihe Alikhani2026-06-25
💬 NLP

Generalised Medical Phrase Grounding

यह शोध पत्र MedGrounder को प्रस्तुत करता है, जो एक नवीन मॉडल है जो मेडिकल फ्रेज ग्राउंडिंग को एक सामान्यीकृत कार्य के रूप में पुनर्गठित करता है जो रिपोर्ट वाक्यों को शून्य, एक, या कई स्कोर किए गए क्षेत्रों से मैप करने में सक्षम है, जिससे यह जटिल निष्कर्षों पर पारंपरिक सिंगल-बॉक्स दृष्टिकोणों से बेहतर प्रदर्शन करता है और इसके लिए कम मानव एनोटेशन की आवश्यकता होती है।

Wenjun Zhang, Shekhar S. Chandra, Aaron Nicolson2026-06-25
💬 NLP

Constituency Structure over Eojeol in Korean Treebanks

यह शोध पत्र कोरियाई ट्रीबैंकों में एक 'ओजियोल' (eojeol)-आधारित रचनात्मक प्रतिनिधित्व का समर्थन करता है, जहाँ संरचनात्मक अस्पष्टताओं को हल करने, क्रॉस-ट्रीबैंक तुलना को सक्षम करने और डिपेंडेंसी संसाधनों के साथ संरेखण को सुगम बनाने के लिए रूपात्मक विवरणों को एक अलग परत में एनकोड किया जाता है।

Jungyeul Park, Chulwoo Park2026-06-25
💬 NLP

Membox: Weaving Topic Continuity into Long-Range Memory for LLM Agents

Membox एक पदानुक्रमित (hierarchical) मेमोरी आर्किटेक्चर है जो LLM एजेंटों के लिए, बातचीत के इतिहास को स्पष्ट रूप से विषय-संगत "बॉक्सेस" में व्यवस्थित करके और उन्हें मैक्रो-टॉपिक ट्रेसेस के माध्यम से जोड़कर दीर्घ-रेंज संवाद समझ को बढ़ाता है, जिससे यह LoCoMo और DialSim बेंचमार्क पर मौजूदा सिमेंटिक रिट्रीवल विधियों से बेहतर प्रदर्शन करता है।

Dehao Tao, Guoliang Ma, Yongfeng Huang, Minghu Jiang2026-06-25
💬 NLP

Paid Voices vs. Public Feeds: Interpretable Cross-Platform Theme-Based Analysis of Climate Discourse

यह शोध पत्र क्रॉस-प्लेटफ़ॉर्म विषयगत विश्लेषण के लिए एक व्याख्यात्मक, अनसुपरवाइज्ड पाइपलाइन प्रस्तुत करता है जो यह प्रकट करता है कि कैसे मेटा के सशुल्क विज्ञापनों पर जलवायु संबंधी विमर्श, ब्लूस्काई की ऑर्गेनिक पोस्ट्स से व्यवस्थित रूप से भिन्न होता है, जिसमें पूर्व रणनीतिक समाधानों के प्रचार पर केंद्रित है और उत्तर प्रणालीगत संकट की आलोचना पर।

Samantha Sudhoff, Pranav Perumal, Zhaoqing Wu, Tunazzina Islam2026-06-25