💬 NLP

The Generalization Ridge: Information Flow in Natural Language Generation

यह शोध पत्र InfoRidge को प्रस्तुत करता है, जो एक सूचना-सैद्धांतिक ढांचा है जो ट्रांसफॉर्मर-आधारित भाषा मॉडलों में एक सुसंगत "जनरलाइजेशन रिज" (सामान्यीकरण शिखा) को प्रकट करता है जहाँ भविष्य कहने वाली सूचना अंतिम परतों में घटने से पहले मध्यवर्ती परतों में चरम पर होती है, जिससे प्राकृतिक भाषा निर्माण के दौरान सामान्यीकरण और स्मृति (मेमोराइजेशन) के बीच संतुलन बनाने में इन मध्य परतों की महत्वपूर्ण भूमिका स्पष्ट होती है।

Ruidi Chang, Chunyuan Deng, Hanjie Chen2026-04-07
💬 NLP

Making Prompts First-Class Citizens for Adaptive LLM Pipelines

यह शोध पत्र SPEAR को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो प्रॉम्प्ट्स को 'फर्स्ट-क्लास सिटीजन' के रूप में मानता है ताकि संरचित प्रबंधन, फीडबैक के आधार पर गतिशील रनटाइम रिफाइनमेंट और नीति-संचालित नियंत्रण सक्षम किया जा सके, जिससे आधुनिक LLM पाइपलाइनों में भंगुर और अपारदर्शी प्रॉम्प्ट्स की सीमाओं को दूर किया जा सके।

Ugur Cetintemel, Shu Chen, Alexander W. Lee, Deepti Raghavan, Duo Lu, Andrew Crotty2026-04-07
💬 NLP

Measuring Competency, Not Performance: Item-Aware Evaluation Across Medical Benchmarks

यह शोध पत्र MedIRT को प्रस्तुत करता है, जो एक आइटम रिस्पॉन्स थ्योरी-आधारित मूल्यांकन ढांचा है जो लेटेंट मेडिकल कॉम्पिटेंसी (अंतर्निहित चिकित्सा सक्षमता) और आइटम विशेषताओं को संयुक्त रूप से मॉडल करके पारंपरिक सटीकता मेट्रिक्स से बेहतर प्रदर्शन करता है, जिससे विविध चिकित्सा बेंचमार्क में लार्ज लैंग्वेज मॉडल्स के अधिक वैध, स्थिर और सूक्ष्म आकलन प्रदान किए जा सकते हैं।

Zhimeng Luo, Lixin Wu, Adam Frisch, Daqing He2026-04-07
💬 NLP

EvoEdit: Evolving Null-space Alignment for Robust and Efficient Knowledge Editing

EvoEdit एक नवीन ज्ञान संपादन (knowledge editing) रणनीति है जो अनुक्रमिक शून्य-स्थान संरेखण (sequential null-space alignment) को नियोजित करके क्रमिक अपडेट में होने वाले विनाशकारी हस्तक्षेप (catastrophic interference) को कम करती है, जिससे मूल और पूर्व में संशोधित ज्ञान दोनों को संरक्षित करते हुए मौजूदा अत्याधुनिक विधियों की तुलना में बेहतर प्रदर्शन और महत्वपूर्ण गति प्राप्त होती है।

Sicheng Lyu, Yu Gu, Xinyu Wang, Jerry Huang, Sitao Luan, Yufei Cui, Xiao-Wen Chang, Peng Lu2026-04-07
💬 NLP

LLMs Judge Themselves: A Game-Theoretic Framework for Human-Aligned Evaluation

यह शोध पत्र स्वचालित पारस्परिक सहकर्मी मूल्यांकन और मतदान एकत्रीकरण के माध्यम से बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के मूल्यांकन के लिए एक नवीन गेम-थ्योरेटिक ढांचे का प्रस्ताव करता है, जो इन मॉडल-जनित रैंकिंग और मानव निर्णय के बीच संरेखण और विचलन का अनुभवजन्य विश्लेषण करता है।

Gao Yang, Yuhang Liu, Siyu Miao, Xinyue Liang, Zhengyang Liu, Heyan Huang2026-04-07
💬 NLP

ProMediate: A Socio-cognitive framework for evaluating proactive agents in multi-party negotiation

यह शोध पत्र ProMediate को प्रस्तुत करता है, जो जटिल बहु-पक्षीय वार्ताओं में सक्रिय (proactive) AI मध्यस्थ एजेंटों के व्यवस्थित मूल्यांकन के लिए पहला सामाजिक-संज्ञानात्मक ढांचा और सिमुलेशन टेस्टबेड है, जो यह प्रदर्शित करता है कि सामाजिक रूप से बुद्धिमान एजेंट आम बेसलाइन की तुलना में सर्वसम्मति निर्माण की प्रभावशीलता और हस्तक्षेप की गति दोनों में काफी बेहतर प्रदर्शन करते हैं।

Ziyi Liu, Bahar Sarrafzadeh, Pei Zhou, Longqi Yang, Jieyu Zhao, Ashish Sharma2026-04-07
💬 NLP

When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms

यह शोध पत्र 28 ऑनलाइन परिदृश्यों में वित्तीय धोखाधड़ी का अनुकरण करने के लिए एक बड़े पैमाने के बेंचमार्क, MultiAgentFraudBench को प्रस्तुत करता है, ताकि यह प्रदर्शित किया जा सके कि कैसे सहयोगात्मक LLM एजेंट धोखाधड़ी के जोखिमों को बढ़ा सकते हैं और हस्तक्षेपों के प्रति अपनी अनुकूलन क्षमता को उजागर करते हुए शमन रणनीतियों का प्रस्ताव दिया जा सके।

Qibing Ren, Zhijie Zheng, Jiaxuan Guo, Junchi Yan, Lizhuang Ma, Jing Shao2026-04-07
💬 NLP

A Simple Method to Enhance Pre-trained Language Models with Speech Tokens for Classification

यह शोध पत्र लंबे स्पीच टोकन अनुक्रमों को एक संक्षिप्त मल्टीमॉडल बैग-ऑफ-वर्ड्स (Bag-of-Words) प्रतिनिधित्व में कम करने के लिए लासो-आधारित (lasso-based) फीचर चयन को लागू करके, वर्गीकरण कार्यों के लिए प्री-ट्रेंड लैंग्वेज मॉडल्स को उन्नत करने हेतु एक सरल और लागत प्रभावी विधि प्रस्तावित करता है, जिसे फिर फॉलसी डिटेक्शन (fallacy detection) और अफेक्टिव कंप्यूटिंग कार्यों पर प्रदर्शन में सुधार करने के लिए सेल्फ-सुपरवाइज्ड लर्निंग के माध्यम से एकीकृत किया जाता है।

Nicolas Calbucura, Jose Guillen, Valentin Barriere2026-04-07
💬 NLP

BLASST: Dynamic BLocked Attention Sparsity via Softmax Thresholding

BLASST एक ट्रेनिंग-फ्री, डायनेमिक स्पार्स अटेंशन मैकेनिज्म है जो नगण्य अटेंशन ब्लॉक्स को छोड़ने के लिए एक फिक्स्ड स्केलर थ्रेशोल्ड का उपयोग करके विभिन्न आर्किटेक्चर पर LLM इन्फरेंस को तेज़ करता है, जिससे नगण्य सटीकता हानि के साथ 1.52x तक की स्पीडअप प्राप्त होती है।

Jiayi Yuan, Cameron Shinn, Kai Xu, Jingze Cui, George Klimiashvili, Guangxuan Xiao, Perkz Zheng, Bo Li, Yuxin Zhou, Zhou (…)2026-04-07
💬 NLP

The Drill-Down and Fabricate Test (DDFT): A Protocol for Measuring Epistemic Robustness in Language Models

यह शोध पत्र ड्रिल-डाउन एंड फैब्रिकेट टेस्ट (DDFT) का परिचय देता है, जो एक प्रोटोकॉल है जो यह प्रदर्शित करता है कि एक भाषा मॉडल की एपिस्टेमिक मजबूती (epistemic robustness)—सिमेंटिक संपीड़न (semantic compression) और प्रतिकूल दबाव के तहत तथ्यात्मक सटीकता बनाए रखने की उसकी क्षमता—मॉडल के आकार या आर्किटेक्चर पर स्वतंत्र है और इसके बजाय महत्वपूर्ण रूप से त्रुटि पहचान क्षमताओं पर निर्भर करती है।

Rahul Baxi2026-04-07