💻 computer science

Where Does the Signal Live? A Web Data Recipe for Medical Encoder Pretraining

यह शोध पत्र फ्रांसीसी चिकित्सा एनकोडर प्रीट्रेनिंग के लिए एक वेब डेटा क्यूरेशन रेसिपी प्रस्तावित करता है जो फाइनमेड (FineMed) कॉर्पस और अत्याधुनिक डॉक्टोबर्ट (DoctoBERT) मॉडल बनाने के लिए मेडिकल-टर्म डेंसिटी फ़िल्टरिंग और सिग्नल-एम्प्लीफाइंग रीफ्रेसिंग को जोड़ता है, जो यह प्रदर्शित करता है कि वेब-स्केल डेटा छोटे, मैन्युअल रूप से क्यूरेट किए गए चिकित्सा कॉर्पस की सीमाओं को प्रभावी ढंग से दूर कर सकता है।

Bofeng Huang, Jacques Sun, Diane Bouchacourt, Nicolas Barascud, Fajwel Fogel2026-06-23
💻 computer science

Plurification in/of language technology -- The integration of culture in next-generation AI

यह शोधपत्र यह तर्क देता है कि अगली पीढ़ी के एआई में वास्तविक सांस्कृतिक संरेखण प्राप्त करने के लिए केवल डेटा विविधीकरण से आगे बढ़कर एक आत्म-चिंतनशील, बहुल सामाजिक-तकनीकी दृष्टिकोण को अपनाना आवश्यक है जो विविध ज्ञानमीमांसाओं को एकीकृत करता है और भाषा प्रौद्योगिकी डिजाइन के सभी स्तरों पर शक्ति और शासन के गहरे मुद्दों को संबोधित करता है।

Gertraud Koch, Fausto Giunchiglia2026-06-23
💬 NLP

From Recognition to Understanding: Unlocking Cognitive Time Series Reasoning with LLMs

यह शोध पत्र बहु-आयामी समय श्रृंखला तर्क (multi-dimensional time series reasoning) के लिए एक मल्टीमॉडल बेंचमार्क, TSCognition, और TSAlign का परिचय देता है, जो एक एकीकृत ढांचा है जो पारंपरिक कर्व-फिटिंग दृष्टिकोणों की सीमाओं को दूर करने और टेम्पोरल डेटा की गहरी संज्ञानात्मक समझ को सक्षम करने के लिए समय श्रृंखला निरूपणों (time series representations) को LLM सिमेंटिक स्पेस के साथ संरेखित करता है।

Xin Qiu, Junlong Tong, Yao Zhang, Yunpu Ma, Wei Zhang, Xiaoyu Shen2026-06-23
💬 NLP

The Score Granularity Gap in Black-Box LLM Classification: A Comparative Study of Confidence Constructions

यह शोध पत्र "स्कोर ग्रैनुलैरिटी गैप" (score granularity gap) को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि जहाँ ब्लैक-बॉक्स LLMs में सिंगल-शॉट मौखिकित आत्मविश्वास स्कोर (verbalized confidence scores) मामलों को अच्छी तरह से रैंक करते हैं, वहीं वे परिनियोजन के लिए केवल कुछ ही मोटे थ्रेशोल्ड प्रदान करते हैं, जबकि मल्टी-क्वेरी एकत्रीकरण कमजोर मॉडलों में सुधार करता है लेकिन मजबूत मॉडलों को खराब कर सकता है।

Ao Sun, Tian Sun, Jiaxing Geng2026-06-23
💬 NLP

Lexical Consensus: Grounded Word Learning and Shared Meaning in Artificial Agents

यह शोध पत्र 'लेक्सिकल कंसेंसस' (Lexical Consensus) ढांचे को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि कृत्रिम एजेंट अर्थ संबंधी संबद्धता के बजाय प्रत्यक्ष बोध की दूरी (perceptual distance) के आधार पर आधारभूत शब्द अर्थों को प्राप्त और स्थिर कर सकते हैं, जो एक सुदृढ़ शिक्षण प्रवणता (learning gradient) को प्रकट करता है जहाँ मूल श्रेणियाँ सीखने में सबसे आसान होती हैं जबकि दूरस्थ-विभक्त अवधारणाएँ संयोग के स्तर के करीब पहुँच जाती हैं, और यह भी रेखांकित करता है कि द्वि-दिशीय नामकरण और पुनर्प्राप्ति जमे हुए प्रत्यक्ष बोध ज्यामितियों (frozen perceptual geometries) के भीतर विशिष्ट तंत्रों पर निर्भर करती हैं।

Patricio M. Vera2026-06-23
💻 computer science

SamatNext v0.2-B: An Exploratory Study of RMS-Normalized Hybrid Decoders for Curriculum Retention in Small Code Models

यह तकनीकी रिपोर्ट SamatNext v0.2-B का परिचय देती है, जो एक 356M-पैरामीटर वाला हाइब्रिड डिकोडर है जो डिफरेंशियल-अटेंशन (Differential-Attention) और डेल्टानेट-प्रेरित (DeltaNet-inspired) परतों को बारी-बारी से उपयोग करके मानक ट्रांसफॉर्मर्स की तुलना में छोटे कोड मॉडल्स में करिकुलम रिटेंशन (curriculum retention) में महत्वपूर्ण सुधार करता है, हालांकि यह लॉन्ग-होरिज़न कैटास्ट्रोफिक फॉरगेटिंग (long-horizon catastrophic forgetting) को पूरी तरह से हल नहीं करता है।

Samat Zharassov2026-06-23
💬 NLP

Evaluating Large Language Models for Hausa and Fongbe Machine Translation: Benchmarks, Failures, and Metric Reliability

यह अध्ययन अंग्रेजी-से-हौसा और अंग्रेजी-से-फोंगबे के लिए चार बड़े भाषा मॉडलों की अनुवाद क्षमताओं का मूल्यांकन करता है, जो दोनों भाषाओं के बीच प्रदर्शन में महत्वपूर्ण असमानताओं, मानव निर्णय के साथ सहसंबंध स्थापित करने में मानक स्वचालित मेट्रिक्स की अविश्वसनीयता, और कम संसाधन वाली अफ्रीकी भाषाओं के लिए बड़े पैमाने पर मूल्यांकन और बहु-मैट्रिक दृष्टिकोण की आवश्यकता को प्रकट करता है।

Mahounan Pericles Adjovi, Roald Eiselen, Prasenjit Mitra2026-06-23
💬 NLP

MixedPEFT: Combining Multiple PEFT Methods with Mixed Objectives for Unsupervised Domain Adaptation

यह शोध पत्र MixedPEFT को प्रस्तुत करता है, जो एक नवीन पैरामीटर-कुशल अनसुपरवाइज्ड डोमेन एडाप्टेशन विधि है जो सोर्स क्लासिफिकेशन और टारगेट मास्कड लैंग्वेज मॉडलिंग को एक साथ अनुकूलित करने के लिए इनवर्टिबल एडेप्टर और LoRA को मिक्स-ऑब्जेक्टिव ट्रेनिंग के साथ जोड़ती है, जिससे मॉडल के केवल 7% ट्रेन करने योग्य पैरामीटर्स का उपयोग करते हुए MNLI डेटासेट पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Mohammed Rawhani, Dervis Karaboga, Ozkan Ufuk Nalbantoglu, Alper Basturk, Bahriye Akay2026-06-23
💬 NLP

From Speech to Text Corpora: Evaluating ASR-Based Data Acquisition for Low-Resource Fongbe and Hausa

यह शोध पत्र कम संसाधन वाले पश्चिम अफ्रीकी भाषाओं के लिए टेक्स्ट कॉर्पोरा उत्पन्न करने हेतु ऑटोमैटिक स्पीच रिकग्निशन (ASR) पाइपलाइनों के उपयोग की प्रभावकारिता का मूल्यांकन करता है, जो यह प्रदर्शित करता है कि MMS-300M को फोंगबे (Fongbe) पर फाइन-ट्यून करने से वर्ड एरर रेट में महत्वपूर्ण कमी आती है, जबकि यह भी प्रकट करता है कि मौजूदा मॉडलों से प्राप्त हौसा (Hausa) ट्रांसक्रिप्शन स्वीकार्य गुणवत्ता के करीब हैं, जबकि फोंगबे के आउटपुट को वर्तमान में आगे के पोस्ट-प्रोसेसिंग की आवश्यकता है।

Mahounan Pericles Adjovi, Victor Olufemi, Roald Eiselen, Prasenjit Mitra2026-06-23
💬 NLP

BabelJudge: Measuring LLM-as-a-Judge Reliability Across Languages and Agent Trajectories

यह शोध पत्र BabelJudge को प्रस्तुत करता है, जो एक ओपन-सोर्स बेंचमार्क और विश्वसनीयता ऑडिट फ्रेमवर्क है, जो नियंत्रित परिवर्तनों (controlled perturbations) के माध्यम से गोल्ड-स्टैंडर्ड लेबल उत्पन्न करके कई भाषाओं और एजेंट ट्रेजेक्टरीज में LLM-as-a-Judge मॉडलों का मूल्यांकन करता है ताकि उन छिपे हुए विफलता मोडों (failure modes) को उजागर किया जा सके जैसे कि पोजीशन और वर्बोसिटी बायस, जिन्हें कच्चे सटीकता मेट्रिक्स पकड़ने में विफल रहते हैं।

Shreyas KC2026-06-23✓ Author reviewed