💬 NLP

The Deliberative Illusion: Diagnosing Factual Attrition and Stance Homogenization in Multi-Agent LLM Deliberation

यह शोध पत्र "डेलिब्रेटिव इल्यूजन" (deliberative illusion) और डेलिबट्रेस (DelibTrace) फ्रेमवर्क को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि मल्टी-एजेंट एलएलएम (LLM) चर्चाएं अक्सर महत्वपूर्ण तथ्यात्मक क्षरण और रुख के समरूपीकरण की ओर ले जाती हैं, जिससे एजेंट महत्वपूर्ण साक्ष्यों को खो देते हैं और संरक्षित तथ्यों के बजाय बेस-मॉडल प्रायोरिटीज़ (base-model priors) पर निर्भर होते हुए सर्वसम्मति तक पहुँच जाते हैं।

Herun Wan, Jiaying Wu, Minnan Luo, Fanxiao Li, Ningnan Wang, Nancy F. Chen, Min-Yen Kan2026-06-03
💬 NLP

The Geometry of LLM-as-Judge: Why Inter-LLM Consensus Is Not Human Alignment

यह शोध पत्र प्रदर्शित करता है कि निर्णय कार्यों में मजबूत अंतर-LLM सहमति अक्सर मानव संरेखण के बजाय एक साझा, संकुचित पूर्वाग्रह को दर्शाती है, क्योंकि LLM निर्णायक मनुष्यों के सापेक्ष एक ज्यामितीय रूप से लंबवत (ऑर्थोगोनल) मूल्यांकन अक्ष और संकुचित स्कोर रेंज प्रदर्शित करते हैं जिसे केवल मानव-आधारित डेटा पर पोस्ट-हॉक अंशांकन (कैलिब्रेशन) द्वारा आंशिक रूप से सुधारा जा सकता है।

Sourabrata Mukherjee, Hamna Hamna, Kalika Bali, Sunayana Sitaram2026-06-03
💬 NLP

ZX-Calculus:Trace-Indexed Dependent Types and Epistemic Semantics

यह शोध पत्र ZX-कैलकुलस (ZX-Calculus) प्रस्तुत करता है, जो मार्टिन-लोफ़ डिपेंडेंट टाइप थ्योरी (Martin-Löf Dependent Type Theory) का एक रूढ़िवादी विस्तार है जो ट्रेस-इंडेक्स्ड प्रकारों (trace-indexed types), प्रेशेफ नॉन-मोनोटोनिक सिमेंटिक्स (presheaf non-monotone semantics) और रचनात्मक AGM विश्वास संशोधन (constructive AGM belief revision) को एकीकृत करता है, जो एक कोक-सत्यापित (Coq-verified) ढांचा प्रदान करता है जो प्रमुख प्रमेयों को स्थापित करता है और पाथ-डिपेंडेंट विश्वास संशोधन और फंक्टर निरंतरता (functor consistency) के बीच एक मौलिक तनाव को प्रकट करता है।

Peng Chen2026-06-03
💬 NLP

G^2C-MT: Graph-Guided Context Selection for Document-Level Machine Translation

यह शोध पत्र G^2C-MT का प्रस्ताव करता है, जो एक नवीन ढांचा है जो लंबी दूरी की निर्भरताओं को प्रभावी ढंग से कैप्चर करने के लिए डेप्थ-बायस्ड रैंडम वॉक का उपयोग करते हुए एक हल्के विमर्श ग्राफ (discourse graph) पर दस्तावेज़-स्तरीय मशीन अनुवाद संदर्भ चयन को एक संरचित पथ खोज समस्या के रूप में मॉडल करता है और विभिन्न बड़े भाषा मॉडलों में मौजूदा बेसलाइन से बेहतर प्रदर्शन करता है।

Baijun Ji, Zixuan Zhou, Xiangyu Duan, Yu Liu, Longbo Sun, Rupu Wei, Bohong Zhao2026-06-03
💬 NLP

Small RL Controller, Large Language Model: RL-Guided Adaptive Sampling for Test-Time Scaling

यह शोध पत्र एक हल्के, सुदृढीकरण शिक्षण (रीइन्फोर्समेंट लर्निंग) आधारित नियंत्रक का प्रस्ताव करता है जो बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के लिए उत्तर की शुद्धता, विलंबता (लेटेंसी) और गणना लागत के बीच गतिशील रूप से संतुलन बनाने हेतु एडेप्टिव सैंपलिंग को एक मार्कोव निर्णय प्रक्रिया के रूप में तैयार करता है, जिससे मौजूदा ह्यूरिस्टिक विधियों की तुलना में बेहतर ट्रेड-ऑफ प्राप्त होता है।

Runpeng Dai, Tong Zheng, Rui Liu, Chengsong Huang, Hongtu Zhu2026-06-03
💬 NLP

Coherence Maximization Improves Pluralistic Alignment

यह शोध पत्र यह प्रदर्शित करता है कि केवल लेबल सटीकता या व्यापक मानवीय पर्यवेक्षण पर निर्भर रहने के बजाय, AI-जनित उदाहरणों में आंतरिक सुसंगतता (internal coherence) को अधिकतम करना, मॉडलों को विविध मानवीय मूल्यों की ओर प्रभावी ढंग से निर्देशित करता है और विभिन्न बेंचमार्क पर सामान्यीकरण (generalization) में महत्वपूर्ण सुधार करता है।

Taslim Mahbub, Yiding Pei, Shi Feng2026-06-03
💬 NLP

Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning

यह शोधपत्र LEDE का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो बड़े भाषा मॉडलों (large language models) में एग्जिट लेयर्स (exit layers) और स्पेक्यूलेशन लेंथ (speculation lengths) को गतिशील रूप से अनुकूलित करने के लिए ऑफलाइन रिइन्फोर्समेंट लर्निंग का लाभ उठाता है, जिससे मानक ऑटोरेग्रेसिव डिकोडिंग और स्टैटिक स्पेक्युलेटिव बेसलाइन्स दोनों की तुलना में महत्वपूर्ण इन्फरेंस स्पीडअप प्राप्त होता है।

Yanyu Zhu, Hoilam Pao, Niu Hu, Wei Guo, Shaoxiong Zhan, Boyu Lai, Zitai Wang, Yongqin Zeng, Hai-Tao Zheng2026-06-03
💬 NLP

Decoupled Smart Contract Audits: Lightweight LLM Framework via Distillation and Aggregation

यह शोध पत्र एक विच्छेदित (decoupled), हल्का LLM ढांचा प्रस्तुत करता है जो मौजूदा मॉडलों की तुलना में काफी कम मापदंडों के साथ अत्याधुनिक स्मार्ट कॉन्ट्रैक्ट सुरक्षा ऑडिटिंग प्रदर्शन प्राप्त करने के लिए डिस्टिलेशन, रैंक-स्टेबलाइज्ड लो-रैंक एडेप्टर्स और एक कस्टम चेन-ऑफ-वेरिफिकेशन एग्रीगेशन रणनीति का उपयोग करता है।

Bagus Rakadyanto Oktavianto Putra, Muhamad Risqi Utama Saputra, Widyawan, Guntur Dharma Putra2026-06-03
🤖 machine learning

FederatedSkill: Federated Learning for Agentic Skill Evolution

FederatedSkill एक गोपनीयता-संरक्षित ढांचा है जो कच्चे प्रक्षेप पथों (raw trajectories) के बजाय सिमेंटिक स्किल पैच को एकत्रित करके सहयोगात्मक एजेंट विकास को सक्षम बनाता है, जिससे व्यक्तिगत स्किल लाइब्रेरी अपडेट संभव होते हैं जो आइसोलेटेड सेल्फ-इम्प्रूवमेंट बेसलाइन्स की तुलना में कार्य सफलता दरों में उल्लेखनीय सुधार करते हैं और कम्प्यूटेशनल लागत को कम करते हैं।

Jingbo Yang, Guanyu Yao, Yang Zhang, Ramana Rao Kompella, Gaowen Liu, Shiyu Chang2026-06-03
💬 NLP

A cross-domain tropical species dataset with Chinese vernacular names and CITES source links

यह शोध पत्र 4,10,000 से अधिक सक्रिय उष्णकटिबंधीय प्रजातियों के एक संस्करणित क्रॉस-डोमेन डेटासेट को प्रस्तुत करता है जो प्रमुख जैव विविधता बुनियादी ढांचों से वर्गीकरण पहचानकर्ताओं को तीन मूल परतों के साथ एकीकृत करता है—एक व्यापार-केंद्रित ऑन्टोलॉजी, सख्त उत्पत्ति वाला एक उच्च-कवरेज चीनी स्थानीय नाम स्तर, और CITES स्रोत जुड़ाव—जबकि वर्तमान सत्यापन सीमाओं को पारदर्शी रूप से संबोधित करता है और इस संसाधन को CC-BY 4.0 लाइसेंस के तहत Zenodo के माध्यम से प्रदान करता है।

Jeff Wang2026-06-03