💬 NLP

Overview of the TalentCLEF 2026: Skill and Job Title Intelligence for Human Capital Management

यह शोध पत्र टैलेंटCLEF 2026 चुनौती के दूसरे संस्करण का एक अवलोकन प्रस्तुत करता है, जिसने दो कार्यों—संदर्भित जॉब-पर्सन मैचिंग और वर्गीकरण के साथ जॉब-स्किल मैचिंग—के माध्यम से ह्यूमन कैपिटल मैनेजमेंट अनुसंधान को उन्नत किया, जिसने 113 टीमों और 400 से अधिक सबमिशन के साथ महत्वपूर्ण भागीदारी आकर्षित की।

Luis Gasco, Hermenegildo Fabregat, Laura García-Sardiña, Paula Estrella, Warre Veys, Casimiro Pío Carrino, Matthias De L (…)2026-07-01
💬 NLP

ShopX: A Foundation Model for Intent-to-Item Fulfillment in Agentic Shopping

यह शोध पत्र ShopX को प्रस्तुत करता है, जो एक ऐसा फाउंडेशन मॉडल है जो इरादे की समझ (intent understanding), निष्पादन योजना (execution planning) और सिमेंटिक आईडी-आधारित आइटम-स्पेस ऑपरेशंस को एकीकृत करता है ताकि एजेंटिक शॉपिंग वर्कफ़्लो में प्रत्यक्ष और लचीला पूर्ति (fulfillment) सक्षम किया जा सके, जिससे पारंपरिक LLM-रैप्ड सर्च पाइपलाइनों की सीमाओं को दूर किया जा सके और ताओबाओ (Taobao) के प्रोडक्शन डेटा का उपयोग करके जटिल कार्यों पर बेहतर प्रदर्शन प्रदर्शित किया जा सके।

Jiacheng Chen, Tao Zhang, Manxi Lin, Dunxian Huang, Teng Shi, Honghao Fu, Mengyan Li, Xinming Zhang, Chenchi Zhang, Xuan (…)2026-07-01
💬 NLP

Seeing Is Not Sharing: Some Vision-Language Models Overestimate Common Ground in Asymmetric Dialogue

यह शोध पत्र प्रकट करता है कि विज़न-लैंग्वेज मॉडल सहयोगात्मक संवाद में आपसी समझ को बढ़ा-चढ़ाकर आंकते हैं क्योंकि वे साझा कार्य-प्रासंगिक सामग्री की मात्र उपस्थिति को स्थापित 'कॉमन ग्राउंड' (साझा आधार) के साथ मिला देते हैं, जो कि गतिशील संवाद इतिहास के बजाय स्थिर संदर्भ संकेतों द्वारा संचालित एक पूर्वाग्रह है।

Nan Li, Albert Gatt, Massimo Poesio2026-07-01
💬 NLP

Adapting Foundation ASR Models to Dysarthric Speech: A Case Study

यह शोध पत्र यह प्रदर्शित करता है कि एक डिसार्थ्रिक (dysarthric) वक्ता के विस्तृत पठन भाषण और उपयोगकर्ता सुधारों पर फाइन-ट्यूनिंग के माध्यम से व्हिस्पर (Whisper) फाउंडेशन मॉडल को व्यक्तिगत बनाना पहचान सटीकता में महत्वपूर्ण सुधार करता है, जिससे 9.7% वर्ड एरर रेट (word error rate) प्राप्त होता है और ऐसे अनुकूलित सिस्टम की व्यावहारिक तैनाती के लिए व्यवहार्यता सिद्ध होती है।

Christian Huber, Laura Kernahan, Alexander Waibel2026-07-01
💬 NLP

STEB: Style Text Embedding Benchmark

यह शोध पत्र STEB को प्रस्तुत करता है, जो स्टाइल टेक्स्ट एम्बेडिंग्स के मूल्यांकन को मानकीकृत करने के लिए 7 भाषाओं में 96 डेटासेट्स तक फैला एक व्यापक ओपन-सोर्स बेंचमार्क है, जो यह प्रकट करता है कि मौजूदा सिमेंटिक एम्बेडिंग्स स्टाइल संबंधी कार्यों में विफल रहते हैं और कोई भी एकल स्टाइल एम्बेडिंग सार्वभौमिक रूप से श्रेष्ठ नहीं है।

Rafael Rivera Soto, Anna Wegmann, Cristina Aggazzotti2026-07-01
💬 NLP

SpikeLogBERT: Energy-Efficient Log Parsing Using Spiking Transformer Networks

SpikeLogBERT एक ऊर्जा-कुशल लॉग पार्सिंग फ्रेमवर्क है जो स्पार्स, इवेंट-ड्रिवन कंप्यूटेशन के माध्यम से सैद्धांतिक ऊर्जा खपत को महत्वपूर्ण रूप से कम करते हुए, HDFS डेटासेट पर अत्याधुनिक सटीकता प्राप्त करने के लिए स्पाइकिंग ट्रांसफॉर्मर आर्किटेक्चर को BERT नॉलेज डिस्टिलेशन के साथ एकीकृत करता है।

Thuan Bui, Duong Do, Tung Vu, Duc-Tho Mai, Cong-Kha Pham2026-07-01
🤖 machine learning

Review Residuals: Update-Conditioned Residual Gating for Transformers

यह शोध पत्र 'रिव्यू रेसिडुअल्स' (Review Residuals) को प्रस्तुत करता है, जो एक नवीन गेटिंग तंत्र है जो वर्तमान अवस्था और प्रस्तावित अपडेट दोनों के आधार पर ट्रांसफॉर्मर अपडेट को स्केल करता है, यह प्रदर्शित करते हुए कि यह योगात्मक, पहचान-संरक्षण वाला रूप सभी गहराइयों पर स्थिर प्रशिक्षण सक्षम बनाता है और विशेष रूप से बड़े मॉडल पैमानों पर मानक रेसिडुअल्स और हाईवे गेट्स की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्रदान करता है।

Kyle Kramer2026-07-01
💬 NLP

Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action

यह शोध पत्र नॉन-कन्वर्सेशनल प्लानिंग थ्योरी ऑफ माइंड (NCP-ToM) फ्रेमवर्क प्रस्तुत करता है ताकि यह मूल्यांकन किया जा सके कि बड़े भाषा मॉडल (LLMs) बातचीत के बजाय कार्यों के माध्यम से विशिष्ट विश्वास अवस्थाओं (belief states) को प्रेरित करने में कितने सक्षम हैं, जिसमें यह पाया गया कि हालांकि GPT-5 इन कार्यों में सफलता दर के मामले में मनुष्यों से बेहतर प्रदर्शन करता है, फिर भी यह संदर्भों के प्रति कम सुदृढ़ बना हुआ है और मनुष्यों की तरह ही, यह सत्य विश्वासों की तुलना में मिथ्या विश्वासों को प्रेरित करने में अधिक संघर्ष करता है।

Ben Slater, Matteo G. Mecattaf, Lucy G. Cheke, John Burden, Winnie Street2026-07-01
💬 NLP

LuxEmo: Expressive Text-to-Speech Corpus for Luxembourgish

यह शोध पत्र LuxEmo को प्रस्तुत करता है, जो एक अर्ध-स्वचालित क्यूरेशन वर्कफ़्लो के माध्यम से RTL प्रसारणों से प्राप्त कम-संसाधन वाली लक्ज़मबर्गिश भाषा के लिए एक 21-घंटे का अभिव्यंजक भाषण संग्रह है, और इस अल्पप्रतिनिधित्व वाली भाषा के लिए भावनात्मक भाषण उत्पन्न करने में उनके प्रदर्शन का मूल्यांकन करने के लिए पांच टेक्स्ट-टू-स्पीच प्रणालियों का बेंचमार्किंग करता है।

Nina Hosseini-Kivanani, Sandipana Dowerah2026-07-01
📊 statistics

Signed-Permutation Coordinate Transport for RMSNorm Transformers

यह शोध पत्र पहचान करता है कि RMSNorm ट्रांसफॉर्मर्स में एक साधारण परम्यूटेशन गेज (SdS_d) के बजाय एक साइन्ड-परम्यूटेशन गेज (BdB_d) होता है, और चेकपॉइंट्स के बीच सुदृढ़ कोऑर्डिनेट ट्रांसपोर्ट को सक्षम करने के लिए एक साइन-मार्जिनलाइज्ड हंगेरियन मैचिंग पद्धति पेश करता है, जिससे व्याख्यात्मकता उपकरणों (interpretability tools), स्टीयरिंग वेक्टर्स और ऑप्टिमाइज़र स्टेट्स की हस्तांतरणीयता में महत्वपूर्ण सुधार होता है और मौजूदा अलाइनमेंट दृष्टिकोणों में समरूपता-प्रेरित विफलताओं का समाधान होता है।

John Sweeney2026-07-01