🤖 machine learning

PageLLM: A Multi-Grained Reward Framework for Whole-Page Optimization with Large Language Models

यह शोध पत्र PageLLM को प्रस्तुत करता है, जो एक मल्टी-ग्रेन्ड रिवॉर्ड फ्रेमवर्क है जो पूरे-पेज खोज और अनुशंसा के लिए मोटे तौर पर पेज-स्तरीय सुसंगतता (coherence) और सूक्ष्म स्तर पर आइटम-स्तरीय प्लेसमेंट को एक साथ अनुकूलित करने के लिए निहित उपयोगकर्ता फीडबैक का लाभ उठाता है, जिससे महंगी मानवीय एनोटेशन की आवश्यकता के बिना रैंकिंग मेट्रिक्स और उत्पादन व्यावसायिक KPIs में महत्वपूर्ण सुधार होता है।

Xinyuan Wang, Liang Wu, Dongjie Wang, Yanjie Fu2026-05-26
🤖 machine learning

FLoRIST: Singular Value Thresholding for Efficient and Accurate Federated Fine-Tuning of Large Language Models

FLoRIST एक फेडरेटेड फाइन-ट्यूनिंग फ्रेमवर्क है जो लार्ज लैंग्वेज मॉडल्स के लिए, स्टैक्ड लोकल एडेप्टर्स पर सिंगुलर वैल्यू डिकंपोजिशन और ट्यूनेबल थ्रेशोल्डिंग का उपयोग करके विषम क्लाइंट्स के बीच गणितीय रूप से सटीक एकत्रीकरण और इष्टतम प्रदर्शन प्राप्त करता है, जिससे उच्च-लागत वाले ग्लोबल मैट्रिक्स पुनर्निर्माण की आवश्यकता को समाप्त करते हुए उत्कृष्ट संचार दक्षता बनी रहती है।

Hariharan Ramesh, Jyotikrishna Dass2026-05-26
🤖 machine learning

From Reasoning to Code: GRPO Optimization for Underrepresented Languages

यह शोध पत्र एक ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO) फ्रेमवर्क का प्रस्ताव करता है जो प्रोलॉग (Prolog) और लिस्प (Lisp) जैसी कम प्रतिनिधित्व वाली प्रोग्रामिंग भाषाओं के लिए बड़े भाषा मॉडलों (LLMs) में कोड जनरेशन और रीजनिंग क्षमताओं को बढ़ाने के लिए निष्पादन-संचालित फीडबैक (execution-driven feedback) को एकीकृत करता है, जो प्रभावी रूप से दुर्लभ प्रशिक्षण डेटा की सीमाओं को दूर करता है।

Federico Pennino, Bianca Raimondi, Massimo Rondelli, Andrea Gurioli, Maurizio Gabbrielli2026-05-26
🤖 AI

SoK: A Comprehensive Security Analysis of Jailbreak Resilience in GPT and DeepSeek Models

यह शोध पत्र GPT-3.5 और GPT-4 की तुलना में DeepSeek मॉडल परिवार का पहला व्यापक जेलब्रेक विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि जहाँ DeepSeek अनुकूलन-संचालित हमलों के विरुद्ध आंशिक लचीलापन प्रदर्शित करता है, वहीं यह GPT-4 की तुलना में प्रॉम्प्ट-आधारित प्रतिकूल इनपुट के प्रति अधिक संवेदनशील बना हुआ है, जो मॉडल दक्षता और सुरक्षा संरेखण सामान्यीकरण के बीच एक महत्वपूर्ण समझौते को रेखांकित करता है।

Xiaodong Wu, Xiangman Li, Qi Li, Lingshuang Liu, Jianbing Ni2026-05-26
💬 NLP

From Multi-Agent Systems and the Semantic Web to Agentic AI: A Unified Narrative of the Web of Agents

यह शोध पत्र 1990 से 2026 तक "एजेंट्स के जाल" (Web of Agents) के विकास का एक एकीकृत वृत्तांत प्रस्तुत करता है, जिसमें यह तर्क दिया गया है कि प्लेटफॉर्म समन्वय से डेटा एनोटेशन और अंततः मॉडल व्याख्या की ओर एक "सिमेंटिक-प्रयास प्रवासन" (semantic-effort migration) तीन विशिष्ट पीढ़ियों को परिभाषित करता है, साथ ही एक तुलनात्मक ढांचे, प्रणाली वर्गीकरण और एजेंटिक एआई (Agentic AI) के लिए निरंतर चुनौतियों और भविष्य की दिशाओं की पहचान करने हेतु हालिया संस्थागत अभिसरण का विश्लेषण भी प्रदान करता है।

Tatiana Petrova (SEDAN SnT, University of Luxembourg, Luxembourg, Luxembourg), Boris Bliznioukov (SEDAN SnT, University (…)2026-05-26
⚡ electrical engineering

QUTCC: Quantile Uncertainty Training and Conformal Calibration for Imaging Inverse Problems

यह शोध पत्र QUTCC को प्रस्तुत करता है, जो एक नवीन ढांचा है जो क्वांटाइल अनिश्चितता प्रशिक्षण (quantile uncertainty training) को स्थानिक रूप से अनुकूलित कॉन्फॉर्मल अंशांकन (spatially-adaptive conformal calibration) के साथ जोड़ता है ताकि उच्च-आयामी इमेजिंग व्युत्क्रम समस्याओं (high-dimensional imaging inverse problems) के लिए कड़े, सांख्यिकीय रूप से वैध अनिश्चितता अंतराल उत्पन्न किए जा सकें और मॉडल मतिभ्रम (model hallucinations) की प्रभावी ढंग से पहचान की जा सके।

Cassandra Tong Ye, Shamus Li, Tyler King, Kristina Monakhova2026-05-26
🤖 machine learning

HiTeC: Hierarchical Contrastive Learning on Text-Attributed Hypergraph with Semantic-Aware Augmentation

यह शोध पत्र HiTeC को प्रस्तुत करता है, जो एक दो-चरणीय पदानुक्रमित कंट्रास्टिव लर्निंग फ्रेमवर्क है जो संरचना-जागरूक टेक्स्ट प्री-ट्रेनिंग, अर्थ-जागरूक डेटा ऑग्मेंटेशन और मल्टी-स्केल कंट्रास्टिव उद्देश्यों को एकीकृत करके टेक्स्ट-एट्रिब्यूटेड हाइपरग्राफ्स पर मौजूदा विधियों की सीमाओं को संबोधित करता है ताकि स्थानीय सहसंबंधों और दीर्घकालिक निर्भरताओं दोनों को कैप्चर किया जा सके।

Mengting Pan, Fan Li, Chen Chen, Xiaoyang Wang, Wenjie Zhang2026-05-26
🤖 AI

Explainable Attention-Guided Stacked Graph Neural Networks for Malware Detection

यह शोध पत्र एक व्याख्यात्मक स्टैकिंग एन्सेम्बल फ्रेमवर्क प्रस्तावित करता है जो कंट्रोल फ्लो ग्राफ से मैलवेयर का पता लगाने के लिए अटेंशन-आधारित मेटा-लर्नर के साथ विविध ग्राफ न्यूरल नेटवर्क को एकीकृत करता है और व्यवहार संबंधी विशेषताओं की व्याख्यात्मक, मॉडल-अज्ञेय (मॉडल-एग्नोस्टिक) व्याख्याएं प्रदान करता है।

Hossein Shokouhinejad, Roozbeh Razavi-Far, Griffin Higgins, Ali A Ghorbani2026-05-26
💬 NLP

LiveMCP-101: Stress Testing and Diagnosing MCP-enabled Agents on Challenging Queries

यह शोध पत्र LiveMCP-101 प्रस्तुत करता है, जो 101 वास्तविक दुनिया के प्रश्नों का एक बेंचमार्क है जिसे एक समानांतर मूल्यांकन ढांचे के माध्यम से MCP-सक्षम एजेंटों का स्ट्रेस-टेस्ट करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि उन्नत (फ्रंटियर) LLMs भी जटिल बहु-चरणीय टूल ऑर्केस्ट्रेशन में संघर्ष करते हैं और भविष्य के सुधारों के मार्गदर्शन के लिए सात विशिष्ट विफलता मोड की पहचान करता है।

Ming Yin, Dinghan Shen, Silei Xu, Sixun Dong, Mian Zhang, Yebowen Hu, Shujian Liu, Jianbing Han, Simin Ma, Song Wang, Sa (…)2026-05-26
🤖 AI

Probing the Preferences of a Language Model: Integrating Verbal and Behavioral Tests of AI Welfare

यह शोध पत्र मौखिक रिपोर्टों की व्यवहार संबंधी डेटा के साथ तुलना करके एआई कल्याण (AI welfare) को मापने के लिए प्रयोगात्मक प्रतिमानों को प्रस्तुत करता है, जो दोनों के बीच उत्साहजनक सहसंबंधों को पाते हुए यह स्वीकार करता है कि एआई चेतना की प्रकृति के बारे में वर्तमान अनिश्चितता कल्याण अवस्थाओं को सफलतापूर्वक मापने के बारे में निश्चित निष्कर्ष निकालने से रोकती है।

Valen Tagliabue, Leonard Dung2026-05-26