💬 NLP

SimSiam Naming Game: A Unified Approach for Representation Learning and Emergent Communication

यह शोध पत्र सिमसियाम नेमिंग गेम (SSNG) का प्रस्ताव करता है, जो एक फीडबैक-मुक्त ढांचा है जो अक्षम सैंपलिंग-आधारित अपडेट को सममित स्व-पर्यवेक्षित प्रतिनिधित्व संरेखण और गमबेल-सॉफ्टमैक्स रिलैक्सेशन से बदल देता है, जिससे एजेंटों को उभरता हुआ संचार सीखने में सक्षम बनाया जा सके जो मौजूदा विधियों की तुलना में जटिल दृश्य डेटासेट पर बेहतर वर्गीकरण प्रदर्शन प्राप्त करता है।

Nguyen Le Hoang, Tadahiro Taniguchi, Fang Tianwei, Akira Taniguchi2026-04-09
💬 NLP

Reward Models Can Improve Themselves: Reward-Guided Adversarial Failure Mode Discovery for Robust Reward Modeling

यह शोध पत्र REFORM को प्रस्तुत करता है, जो एक स्व-सुधार (self-improving) ढांचा है जो रिवॉर्ड-गाइडेड कंट्रोल्ड डिकोडिंग के माध्यम से मॉडल का उपयोग करके स्वयं प्रतिकूल विफलता मोड (adversarial failure modes) उत्पन्न करके रिवॉर्ड मॉडल की मजबूती को बढ़ाता है, जिससे प्रदर्शन से समझौता किए बिना मिसअलाइन्ड व्यवहारों को सुधारने के लिए प्रशिक्षण डेटा को संवर्धित किया जाता है।

Pankayaraj Pathmanathan, Furong Huang2026-04-09
💬 NLP

Soft Head Selection for Injecting ICL-Derived Task Embeddings

यह शोध पत्र SITE को प्रस्तुत करता है, जो एक ग्रेडिएंट-आधारित विधि है जो ICL-व्युत्पन्न एम्बेडिंग्स (embeddings) को इंजेक्ट करने के लिए कार्य-प्रासंगिक अटेंशन हेड्स की पहचान करती है, जो विविध कार्यों और मॉडल स्केल्स पर PEFT की तुलना में कम प्रशिक्षण योग्य पैरामीटर्स की आवश्यकता के साथ मौजूदा एम्बेडिंग-आधारित अनुकूलन और फ्यू-शॉट ICL दृष्टिकोणों से काफी बेहतर प्रदर्शन करती है।

Jungwon Park, Jimyeong Kim, Changin Choi, Wonjong Rhee2026-04-09
💬 NLP

Contrastive Decoding Mitigates Score Range Bias in LLM-as-a-Judge

यह शोध पत्र पहचानता है कि जज के रूप में उपयोग किए जाने वाले LLMs सीधे रेटिंग असाइन करते समय महत्वपूर्ण स्कोर रेंज बायस (score range bias) प्रदर्शित करते हैं, और इस समस्या को कम करने के लिए एक कंट्रास्टिव डिकोडिंग (contrastive decoding) विधि प्रस्तावित करता है, जो विभिन्न सारांशीकरण कार्यों में मानवीय निर्णयों के साथ संरेखण में 11.7% तक का सापेक्ष सुधार प्राप्त करती है।

Yoshinari Fujinuma2026-04-09
💬 NLP

VisCoder2: Building Multi-Language Visualization Coding Agents

यह शोध पत्र VisCoder2 को प्रस्तुत करता है, जो बड़े पैमाने के VisCode-Multi-679K डेटासेट पर प्रशिक्षित बहु-भाषा विज़ुअलाइज़ेशन कोडिंग मॉडल्स का एक परिवार है और जिसे VisPlotBench के माध्यम से मूल्यांकित किया गया है, जो 12 प्रोग्रामिंग भाषाओं में इटरेटिव सेल्फ-डीबगिंग के माध्यम से मौजूदा ओपन-सोर्स बेसलाइन से काफी बेहतर प्रदर्शन करता है और प्रोप्राइटरी मॉडल के प्रदर्शन के करीब पहुँचता है।

Yuansheng Ni, Songcheng Cai, Xiangchao Chen, Jiarong Liang, Zhiheng Lyu, Jiaqi Deng, Kai Zou, Ping Nie, Fei Yuan, Xiang (…)2026-04-09
💬 NLP

How to Evaluate Speech Translation with Source-Aware Neural MT Metrics

यह शोध पत्र स्पीच ट्रांसलेशन (वाक् अनुवाद) के लिए सोर्स-अवेयर न्यूरल मेट्रिक्स का पहला व्यवस्थित अध्ययन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि एएसआर (ASR) ट्रांसक्रिप्ट्स और बैक-ट्रांसलेशन, एक नवीन क्रॉस-लिंगुअल री-सेगमेंटेशन एल्गोरिदम द्वारा संवर्धित होकर, प्रभावी सिंथेटिक सोर्स प्रॉक्सी के रूप में कार्य करते हैं—ताकि तब भी मानवीय निर्णयों के साथ मजबूत सहसंबंध प्राप्त किया जा सके जब सोर्स ट्रांसक्रिप्ट्स उपलब्ध न हों।

Mauro Cettolo, Marco Gaido, Matteo Negri, Sara Papi, Luisa Bentivogli2026-04-09
💻 computer science

Knowledge Graphs Generation from Cultural Heritage Texts: Combining LLMs and Ontological Engineering for Scholarly Debates

यह शोध पत्र ATR4CH प्रस्तुत करता है, जो एक व्यवस्थित पाँच-चरणीय कार्यप्रणाली है जो अनस्ट्रक्चर्ड सांस्कृतिक विरासत ग्रंथों को स्ट्रक्चर्ड, क्वेरेबल नॉलेज ग्राफ में स्वचालित रूप से परिवर्तित करने के लिए लार्ज लैंग्वेज मॉडल्स को ऑन्टोलॉजिकल इंजीनियरिंग के साथ जोड़ती है, जो प्रामाणिकता मूल्यांकन संबंधी बहसों पर एक केस स्टडी के माध्यम से उच्च निष्कर्षण सटीकता और लागत प्रभावी परिनियोजन का प्रदर्शन करती है।

Andrea Schimmenti, Valentina Pasqual, Fabio Vitali, Marieke van Erp2026-04-09
💬 NLP

Improved Evidence Extraction and Metrics for Document Inconsistency Detection with LLMs

यह शोध पत्र एक रेडैक्ट-एंड-रिट्राय (redact-and-retry) फ्रेमवर्क को पेश करके LLM-आधारित दस्तावेज़ विसंगति का पता लगाने पर सीमित शोध को संबोधित करता है, जिसमें सीमित फ़िल्टरिंग और नए व्यापक मेट्रिक्स शामिल हैं, जो साक्ष्य निष्कर्षण प्रदर्शन में महत्वपूर्ण सुधार करते हैं और एक नए जारी किए गए अर्ध-सिंथेटिक डेटासेट का उपयोग करके मान्य किए जाते हैं।

Nelvin Tan, Yaowen Zhang, James Asikin Cheung, Fusheng Liu, Yu-Ching Shih, Dong Yang2026-04-09
💬 NLP

PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning

यह शोधपत्र PEARL प्रस्तुत करता है, जो एक बाहरी प्राथमिकता स्मृति (external preference memory) से सुसज्जित एक सुदृढीकरण लर्निंग (reinforcement learning) ढांचा है, जो नए प्रस्तावित CalConflictBench पर प्रदर्शित होने के अनुसार, उपयोगकर्ता की प्राथमिकताओं को गतिशील रूप से सीखकर और उनके अनुकूल होकर लंबी अवधि के कैलेंडर संघर्षों को हल करने में लार्ज लैंग्वेज मॉडल्स के प्रदर्शन में महत्वपूर्ण सुधार करता है।

Bingxuan Li, Jeonghwan Kim, Cheng Qian, Xiusi Chen, Eitan Anzenberg, Niran Kundapur, Heng Ji2026-04-09
💻 computer science

WebExpert: domain-aware web agents with critic-guided expert experience for high-precision search

WebExpert एक डोमेन-जागरूक वेब एजेंट है जो वित्त और बायोमेडिसिन जैसे विशिष्ट क्षेत्रों में उच्च-परिशुद्धता खोज को बढ़ाने के लिए वाक्य-स्तरीय अनुभव पुनर्प्राप्ति (sentence-level experience retrieval), कमजोर रूप से पर्यवेक्षित पहलू प्रेरण (weakly supervised facet induction), और प्राथमिकता-अनुकूलित योजना (preference-optimized planning) को एकीकृत करता है ताकि मौजूदा बेसलाइन की तुलना में उत्तर की सटीकता में उल्लेखनीय सुधार किया जा सके और नेविगेशन चरणों को कम किया जा सके।

Yuelin Hu, Zhengxue Cheng, Ronghua Wu, Qunshan Gu, Hongwei Hu, Wei Liu, Qiao Liang, Li Song2026-04-09