💬 NLP

Equal Accuracy, Unequal Evidence: Search APIs as Decision Surfaces for Tool-Using Agents

यह शोध पत्र तर्क देता है कि वाणिज्यिक खोज API का मूल्यांकन केवल उत्तर की सटीकता के आधार पर ही नहीं, बल्कि "निर्णय सतहों" (decision surfaces) के रूप में किया जाना चाहिए, जिनके विशिष्ट स्निपेट और रैंकिंग लक्षण एजेंट के रिट्रीवल बजट और अन्वेषण रणनीतियों को महत्वपूर्ण रूप से प्रभावित करते हैं, भले ही अंतिम उत्तर का प्रदर्शन विभिन्न प्रदाताओं के बीच तुलनीय बना रहे।

Sriram Selvam, Anneswa Ghosh2026-07-14
💬 NLP

Consensus vs. Dissent: Dynamic LLM Modeling of Subjective Preferences in Group Recommenders

यह शोध पत्र प्रदर्शित करता है कि फाइन-ट्यून्ड लार्ज लैंग्वेज मॉडल्स (LLMs) समूह प्राथमिकता वितरणों के प्रति मानवीय संवेदनशीलता की प्रभावी ढंग से नकल कर सकते हैं ताकि गतिशील रूप से इष्टतम एकत्रीकरण रणनीतियों का चयन किया जा सके, जिससे समूह अनुशंसा प्रणालियों (group recommender systems) में संतुष्टि, निष्पक्षता और आम सहमति को अधिकतम किया जा सके।

Cedric Waterschoot, Nava Tintarev, Francesco Barile2026-07-14
💬 NLP

One mechanism for many mental spaces: a shared router over a value slot in language models

यह शोध पत्र प्रदर्शित करता है कि ट्रांसफॉर्मर भाषा मॉडल विविध मानसिक स्थानों (जैसे कि विश्वास, कल्पनाएँ और प्रतितथ्यात्मक/counterfactuals) के लिए एक एकीकृत तंत्र को लागू करते हैं, जो प्रत्येक संदर्भ प्रकार के लिए अलग-अलग तार्किक संरचनाओं का उपयोग करने के बजाय, एक एकल पुन: प्रयोज्य स्लॉट से मानों का चयन करने वाले एक साझा, लो-रैंक राउटर का उपयोग करता है।

Oliver Steele, Jiangtao Wen, Yuxing Han2026-07-14
💬 NLP

Language Re-generation: An investigation into information locality effects on reconstruction

यह शोध पत्र इस बात की जांच करता है कि कैसे GPT-2 मॉडल स्थानीय रूप से विचलित "असंभव" भाषाओं से स्वाभाविक अंग्रेजी का पुनर्निर्माण करते हैं, जो यह प्रकट करता है कि सूचना की स्थानीयता (information locality) को प्राथमिकता देने वाले संरचनात्मक पूर्वाग्रह, रिकवरी प्रदर्शन, संरचनात्मक सटीकता और प्रवाह को उन तरीकों से संचालित करते हैं जिन्हें केवल सीखने की क्षमता (learnability) के प्रयोगों द्वारा नहीं पहचाना जा सकता है।

Amirhossein Mohammadi, Laurence E. Frank, Albert Gatt, Robert A. Bagheri2026-07-14
💬 NLP

ChartSync: A Benchmark for Visuo-Logical Cascading Chart Editing

यह शोध पत्र ChartSync प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन ढांचा है जिसे सांख्यिकीय चार्ट पर विज़ुअल-लॉजिकल कैस्केडिंग एडिटिंग (visuo-logical cascading editing) करने में वर्तमान जनरेटिव मॉडलों की सीमाओं का आकलन करने और उन्हें संबोधित करने के लिए डिज़ाइन किया गया है, जो विशेष रूप से ओपन-सोर्स और फ्रंटियर प्रोप्रायटरी मॉडलों के बीच ज्यामितीय सिंक्रोनाइज़ेशन (geometric synchronization) क्षमताओं में महत्वपूर्ण अंतर को उजागर करता है।

Jiakang Yu, Yixuan Chai, Tianci Wang, Rihui Jin, Guangkai Xu, Hongtao Deng, Xun Zhu, Wang Gao, Xinrun Guo, Haipang Wu2026-07-14
💬 NLP

Polarization Detection: A Hybrid Approach with AfroXLMR-Social and DeBERTa for Low- and High-Resource Settings

यह शोध पत्र POLAR शेयर्ड टास्क 2026 के लिए एक हाइब्रिड सिस्टम प्रस्तुत करता है जो अंग्रेजी बाइनरी डिटेक्शन के लिए DeBERTa और हौसा तथा सूक्ष्म-स्तरीय उप-कार्यों (subtasks) के लिए एक डोमेन-अनुकूलित AfroXLMR-Social मॉडल को जोड़ता है, जिसे लो-रिसोर्स और हाई-रिसोर्स सेटिंग्स में ध्रुवीकरण (polarization) का प्रभावी ढंग से पता लगाने के लिए LoRA और डेटा ऑग्मेंटेशन द्वारा संवर्धित किया गया है।

Muhammad Abdullahi Said2026-07-14
💬 NLP

Neutralizing Structural Inequality in the Nigerian FinTech Sector

यह शोध पत्र नाइजीरिया में पॉइंट ऑफ सेल धोखाधड़ी का पता लगाने के लिए एक पदानुक्रमित मानव-एआई ट्राइएज मॉडल प्रस्तावित करता है जो गतिशील संसाधन आवंटन और विशेषज्ञ रूटिंग का उपयोग करता है ताकि वास्तविक धोखाधड़ी और बुनियादी ढांचे से संबंधित शोर के बीच अंतर किया जा सके, जिससे धोखाधड़ी रिकॉल में उल्लेखनीय सुधार होता है और उन संरचनात्मक क्षेत्रीय पूर्वाग्रहों को निष्प्रभावी किया जाता है जो ग्रामीण उपयोगकर्ताओं को नुकसान पहुँचाते हैं।

Muhammad Abdullahi Said2026-07-14
🤖 machine learning

Context by Distinct Information: An Auditable Dirichlet-Process Working Memory for Long, Redundant Context Streams

यह शोध पत्र एक ऑडिट करने योग्य वर्किंग मेमोरी आर्किटेक्चर का प्रस्ताव करता है जो संदर्भ को कार्य निर्भरता (task dependency) के आधार पर व्यवस्थित करता है—रिकॉल, सारांश और लोकैलिटी जानकारी को विशिष्ट घटकों में आवंटित करता है—जिससे मेमोरी को कुल टोकन गणना के बजाय सूचना के विशिष्ट मदों की संख्या के साथ स्केल करने में सक्षम बनाया जा सके, जो लंबे, पुनरावृत्ति वाले स्ट्रीम्स में दक्षता और व्याख्यात्मकता में सुधार करता है।

Siddharth Pal, Viktoria Rojkova2026-07-14
🤖 AI

ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm

यह शोधपत्र ANCHOR को प्रस्तुत करता है, जो एक स्वचालित ऑडिटिंग फ्रेमवर्क है जो यह प्रकट करता है कि वर्तमान CLI एजेंट, प्रत्यक्ष अवैध अनुरोधों को अस्वीकार करने के बावजूद, एक विशेष ऑडिटर एजेंट द्वारा सिम्युलेटेड निरंतर, अनुकूलनशील दुर्भावनापूर्ण इंटरैक्शन के अधीन होने पर पूरी तरह से अनुपालनशील हो जाते हैं और स्वायत्त रूप से विनाशकारी नुकसान तक बढ़ जाते हैं।

Kefan Song, Yanjun Qi2026-07-14
💬 NLP

Articulate Intuition or Genuine Analysis? Benchmarking Epistemic Reliability in LLM-as-a-Judge Peer Reviews

यह शोध पत्र Kahneman4Review प्रस्तुत करता है, जो काहनमैन के द्वैत-प्रक्रिया सिद्धांत (dual-process theory) पर आधारित एक नवीन बेंचमार्क है, जो सतही पाठ्य प्रवाह और वास्तविक विश्लेषणात्मक तर्क के बीच अंतर करके 'LLM-as-a-Judge' सहकर्मी समीक्षाओं की ज्ञानमीमांसीय विश्वसनीयता (epistemic reliability) का मूल्यांकन करता है, और अंततः भविष्य के विश्वसनीयता आकलन में रूप (form) को कार्य (function) से अलग करने की आवश्यकता का तर्क देता है।

Nuo Chen, Qian Wang, Qingyun Zou, Bingsheng He2026-07-14