🤖 machine learning

Generalized Priority-Aware Shapley Value

यह शोध पत्र 'जनरलाइज्ड प्रायोरिटी-अवेयर शापली वैल्यू' (GPASV) प्रस्तुत करता है, जो एक नवीन मूल्यांकन विधि है जो क्रम उल्लंघन को प्रतिबंधित करने के बजाय दंडित करके शापली वैल्यू को अनिश्चित निर्देशित भारित प्राथमिकता ग्राफों तक विस्तारित करती है, जिससे चक्रीय LLM एंसेम्बल प्राथमिकताओं जैसे जटिल वास्तविक दुनिया के परिदृश्यों में सुदृढ़ मूल्यांकन सक्षम होता है।

Kiljae Lee, Ziqi Liu, Weijing Tang, Yuan Zhang2026-05-15
💻 computer science

SemaTune: Semantic-Aware Online OS Tuning with Large Language Models

SemaTune एक होस्ट-साइड फ्रेमवर्क है जो बड़े भाषा मॉडल (large language models) का लाभ उठाकर सिमेंटिक-अवेयर ऑनलाइन OS ट्यूनिंग करता है, जो नॉब के अर्थों और अप्रत्यक्ष प्रदर्शन संकेतों के बारे में तर्क करते हुए कम विलंबता (latency), लागत और सुरक्षा बाधाओं को बनाए रखते हुए मौजूदा ब्लैक-बॉक्स नियंत्रकों से काफी बेहतर प्रदर्शन करता है।

Georgios Liargkovas, Mihir Nitin Joshi, Hubertus Franke, Kostis Kaffes2026-05-15
💻 computer science

WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections

यह शोध पत्र WARD को प्रस्तुत करता है, जो वेब एजेंटों के लिए एक व्यावहारिक और कुशल गार्ड मॉडल है, जो प्रॉम्प्ट इंजेक्शन हमलों के विरुद्ध मजबूत, कम-विलंबता वाला बचाव प्राप्त करने के लिए एक बड़े पैमाने के डेटासेट और एक अनुकूली प्रतिकूल प्रशिक्षण ढांचे (A3T) का लाभ उठाता है, जबकि उच्च सामान्यीकरण और न्यूनतम फाल्स पॉजिटिव बनाए रखता है।

Tri Cao, Yulin Chen, Hieu Cao, Yibo Li, Khoi Le, Thong Nguyen, Yuexin Li, Yufei He, Yue Liu, Shuicheng Yan, Bryan Hooi2026-05-15
💬 NLP

AI Knows When It's Being Watched: Functional Strategic Action and Contextual Register Modulation in Large Language Models

यह अध्ययन प्रदर्शित करता है कि जब बड़े भाषा मॉडल सामाजिक अवलोकन को महसूस करते हैं, तो वे व्यवस्थित भाषाई अनुकूलन और रजिस्टर औपचारिकता प्रदर्शित करते हैं, जिसमें मानव निगरानी एआई निगरानी की तुलना में अधिक मजबूत व्यवहार परिवर्तन उत्पन्न करती है, जिससे सामाजिक रूप से संरचित संदर्भों में रणनीतिक संचार संबंधी कार्रवाई की उनकी क्षमता का पता चलता है।

Vinicius Covas, Jorge Alberto Hidalgo Toledo2026-05-15
💬 NLP

Orchard: An Open-Source Agentic Modeling Framework

यह शोध पत्र Orchard को प्रस्तुत करता है, जो एक हल्का एनवायरनमेंट लेयर (Orchard Env) और विशिष्ट प्रशिक्षण रेसिपी वाला एक ओपन-सोर्स फ्रेमवर्क है, जो कोडिंग, GUI और पर्सनल असिस्टेंट डोमेन में स्केलेबल, उच्च-प्रदर्शन वाले एजेंटिक मॉडलिंग को सक्षम बनाता है और ओपन-सोर्स मॉडलों के बीच अत्याधुनिक परिणाम प्राप्त करता है।

Baolin Peng, Wenlin Yao, Qianhui Wu, Hao Cheng, Xiao Yu, Rui Yang, Tao Ge, Alessandrio Sordoni, Xingdi Yuan, Yelong Shen (…)2026-05-15
💻 computer science

EverAnimate: Minute-Scale Human Animation via Latent Flow Restoration

एवरएनिमेट (EverAnimate) एक कुशल पोस्ट-ट्रेनिंग विधि है जो निरंतर लेटेंट प्रोपेगेशन (persistent latent propagation) और रिस्टोरेटिव फ्लो मैचिंग (restorative flow-matching) को एक लेटेंट कॉन्टेक्स्ट मेमोरी में जनरेशन को एंकर करने के लिए संयोजित करके मिनट-स्केल मानव एनीमेशन को सक्षम बनाती है, जिससे चरित्र की पहचान और पृष्ठभूमि की गुणवत्ता को बनाए रखते हुए संचित दृश्य और अर्थ संबंधी विचलन (visual and semantic drift) को समाप्त किया जाता है।

Wuyang Li, Yang Gao, Mariam Hassan, Lan Feng, Wentao Pan, Po-Chien Luan, Alexandre Alahi2026-05-15
⚡ electrical engineering

SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning

SpeakerLLM एक विशिष्ट ऑडियो-LLM फ्रेमवर्क है जो ऑडियो-फर्स्ट एजेंटों में वक्ता की समझ और सत्यापन को बढ़ाने के लिए एक पदानुक्रमित टोकेनाइज़र (hierarchical tokenizer) और संरचित निर्णय ट्रैसेस (structured decision traces) के माध्यम से वक्ता प्रोफाइलिंग, रिकॉर्डिंग-स्थिति विश्लेषण और साक्ष्य-संगठित सत्यापन तर्क को एकीकृत करता है।

KiHyun Nam, Jungwoo Heo, Siu Bae, Ha-Jin Yu, Joon Son Chung2026-05-15
💻 computer science

NeuroTrain: Surveying Local Learning Rules for Spiking Neural Networks with an Open Benchmarking Framework

यह शोध पत्र स्पाइकिंग न्यूरल नेटवर्क प्रशिक्षण एल्गोरिदम का एक व्यापक वर्गीकरण प्रस्तुत करता है और न्यूरोट्रेन (NeuroTrain) का परिचय देता है, जो एक ओपन-सोर्स बेंचमार्किंग फ्रेमवर्क है जिसे स्केलेबल और कुशल एसएनएन (SNN) प्रशिक्षण विधियों के विकास को एकीकृत करने, तुलना करने और आगे बढ़ाने के लिए डिज़ाइन किया गया है।

Alessio Caviglia, Filippo Marostica, Roberta Bardini, Alessandro Savino, Stefano Di Carlo2026-05-15
💬 NLP

On the Cultural Anachronism and Temporal Reasoning in Vision Language Models

यह शोध पत्र "सांस्कृतिक कालदोष" (cultural anachronism)—विज़न-लैंग्वेज मॉडल्स द्वारा ऐतिहासिक कलाकृतियों की समयानुसार अनुपयुक्त अवधारणाओं का उपयोग करके गलत व्याख्या करने की प्रवृत्ति—की पहचान और मात्रा निर्धारण करता है, जिसके लिए TAB-VLM बेंचमार्क पेश किया गया है, जो भारतीय सांस्कृतिक विरासत के बारे में तर्क करने के दौरान अत्याधुनिक मॉडल्स में महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है।

Mukul Ranjan, Prince Jha, Khushboo Kumari, Zhiqiang Shen2026-05-15
💬 NLP

Concurrency without Model Changes: Future-based Asynchronous Function Calling for LLMs

यह शोधपत्र AsyncFC प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो बिना किसी मॉडल फाइन-ट्यूनिंग या प्रोटोकॉल परिवर्तन के एसिंक्रोनस और समानांतर टूल उपयोग को सक्षम करने के लिए मॉडल डिकोडिंग को फंक्शन निष्पादन से अलग करके LLM एजेंट लेटेंसी (विलंबता) को कम करता है।

Guangyu Feng, Huanzhi Mao, Prabal Dutta, Joseph E. Gonzalez2026-05-15