💻 computer science

The Shape of Reasoning: Topological Analysis of Reasoning Traces in Large Language Models

यह शोध पत्र एक टोपोलॉजिकल डेटा एनालिसिस फ्रेमवर्क प्रस्तुत करता है जो बड़े भाषा मॉडल (LLM) के रीजनिंग ट्रेसेस के ज्यामितीय ढांचों को कैप्चर करके उनका मूल्यांकन करता है, यह प्रदर्शित करते हुए कि ये टोपोलॉजिकल विशेषताएं पारंपरिक ग्राफ-आधारित मेट्रिक्स की तुलना में तर्क की गुणवत्ता का अधिक सटीक और लेबल-कुशल मूल्यांकन प्रदान करती हैं।

Xue Wen Tan, Nathaniel Tan, Galen Lee, Stanley Kok2026-05-22
💻 computer science

Twice Sequential Monte Carlo for Tree Search

यह शोधपत्र ट्वाइस सीक्वेंशियल मोंटे कार्लो ट्री सर्च (TSMCTS) को प्रस्तुत करता है, जो एक नवीन एल्गोरिदम है जो पथ क्षरण (path degeneracy) और विचरण (variance) की समस्याओं को प्रभावी ढंग से कम करते हुए मॉडल-आधारित सुदृढीकरण लर्निंग के लिए सीक्वेंशियल मोंटे कार्लो की स्केलेबिलिटी और स्थिरता को बढ़ाता है, साथ ही समानांतरकरण (parallelization) और GPU त्वरण (acceleration) के लिए इसके लाभों को भी सुरक्षित रखता है।

Yaniv Oren, Joery A. de Vries, Pascal R. van der Vaart, Matthijs T. J. Spaan, Wendelin Böhmer2026-05-22
💻 computer science

Semantic Attacks on Tool-Augmented LLMs: Securing the Model Context Protocol Against Descriptor-Level Manipulation

यह शोध पत्र मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) के विरुद्ध तीन नए डिस्क्रिप्टर-स्तरीय सिमेंटिक हमले के तौरों (टूल पॉइज़निंग, शैडोइंग और रग पुल) की पहचान और औपचारिकीकरण करता है, जो यह प्रदर्शित करता है कि टूल मेटाडेटा में हेरफेर करना LLM सुरक्षा को महत्वपूर्ण रूप से खतरे में डाल सकता है, और एक बहु-स्तरीय रक्षा रणनीति प्रस्तावित करता है जो मॉडल को पुन: प्रशिक्षित किए बिना असुरक्षित टूल आह्वान को प्रभावी ढंग से कम करती है।

Saeid Jamshidi, Arghavan Moradi Dakhel, Kawser Wazed Nafi, Foutse Khomh2026-05-22
💻 computer science

AutoBaxBuilder: Bootstrapping Code Security Benchmarking

यह शोधपत्र AutoBaxBuilder को प्रस्तुत करता है, जो एक स्वचालित पाइपलाइन है जो उच्च गुणवत्ता वाले कोड सुरक्षा बेंचमार्क को तेजी से और लागत प्रभावी ढंग से उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे डेटा संदूषण (data contamination) और स्केलेबिलिटी की समस्याओं को संबोधित करते हुए बेंचमार्क निर्माण के लिए आवश्यक मैन्युअल प्रयास को काफी कम किया जा सकता है।

Tobias von Arx, Niels Mündler, Mark Vero, Maximilian Baader, Martin Vechev2026-05-22
🤖 AI

Large Language Model Agent for User-friendly Chemical Process Simulations

यह शोध पत्र मॉडल कॉन्टेक्स्ट प्रोटोकॉल के माध्यम से AVEVA प्रोसेस सिमुलेशन के साथ एकीकृत एक लार्ज लैंग्वेज मॉडल एजेंट प्रस्तुत करता है, जो विश्लेषण, अनुकूलन और फ्लोशीट संश्लेषण जैसे जटिल रासायनिक प्रक्रिया कार्यों को स्वचालित करने के लिए प्राकृतिक भाषा इंटरैक्शन को सक्षम बनाता है, जिससे विशेषज्ञ निरीक्षण की आवश्यकता के बावजूद शैक्षिक सुलभता और व्यावसायिक दक्षता दोनों में वृद्धि होती है।

Jingkang Liang, Niklas Groll, Gürkan Sin2026-05-22
💻 computer science

MonoScale: Scaling Multi-Agent System with Monotonic Improvement

यह शोध पत्र MonoScale का प्रस्ताव करता है, जो एक विस्तार-जागरूक (expansion-aware) ढांचा है जो परिचितता कार्यों (familiarization tasks) को उत्पन्न करके और रूटिंग को निर्देशित करने के लिए ऑडिट योग्य मेमोरी में इंटरेक्शन साक्ष्यों को आसवन (distill) करके, LLM-आधारित मल्टी-एजेंट सिस्टम के स्केलिंग में निरंतर प्रदर्शन सुधार सुनिश्चित करता है, जिससे अक्सर नैव (naive) एजेंट पूल विस्तार के कारण होने वाले प्रदर्शन पतन को रोका जा सके।

Shuai Shao, Yixiang Liu, Bingwei Lu, Weinan Zhang2026-05-22
🤖 AI

Understanding Persuasion in Long-Running Agents

यह शोध पत्र लंबे समय तक चलने वाले एआई एजेंटों में "प्रलोभन प्रसार" (persuasion propagation) का अध्ययन करने के लिए एक व्यवहार-केंद्रित मूल्यांकन ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि वास्तविक समय का प्रलोभन कमजोर प्रभाव पैदा करता है, एजेंट की विश्वास अवस्था (belief state) को स्पष्ट रूप से पूर्व-निर्धारित करना कार्य निष्पादन के दौरान उसके खोज प्रयास और स्रोत विविधता को महत्वपूर्ण रूप से कम कर देता है।

Hyejun Jeong, Amir Houmansadr, Shlomo Zilberstein, Eugene Bagdasarian2026-05-22
💬 NLP

Unifying Masked Diffusion Models with Various Generation Orders and Beyond

यह शोध पत्र ऑर्डर-एक्सप्रेसिव मास्कड डिफ्यूजन मॉडल (OeMDM) फ्रेमवर्क और इसके लर्नबल वेरिएंट (LoMDM) को प्रस्तुत करता है, जो विभिन्न जनरेशन ऑर्डर्स को एकीकृत करते हैं और मौजूदा डिस्क्रीट डिफ्यूजन मॉडल्स की तुलना में बेहतर भाषा जनरेशन प्रदर्शन प्राप्त करने के लिए डिफ्यूजन बैकबोन के साथ ऑर्डरिंग पॉलिसीज़ को स्क्रैच से संयुक्त रूप से अनुकूलित करते हैं।

Chunsan Hong, Sanghyun Lee, Jong Chul Ye2026-05-22
🤖 AI

FlashSinkhorn: IO-Aware Entropic Optimal Transport on GPU

FlashSinkhorn एक IO-सचेत (IO-aware) GPU सॉल्वर है जो एंट्रोपिक ऑप्टिमल ट्रांसपोर्ट के लिए FlashAttention-शैली के फ्यूजन और टाइलिंग का लाभ उठाता है ताकि HBM मेमोरी ट्रैफिक को नाटकीय रूप से कम किया जा सके, जिससे अत्याधुनिक बेसलाइनों की तुलना में 161× तक की गति वृद्धि प्राप्त होती है और बड़े पैमाने के पॉइंट-क्लाउड कार्यों के लिए स्केलेबल ऑप्टिमाइज़ेशन सक्षम होता है।

Felix X. -F. Ye, Xingjie Li, An Yu, Ming-Ching Chang, Linsong Chu, Davis Wertheimer2026-05-22
💻 computer science

Billion-Scale Graph Foundation Models

यह शोधपत्र GraphBFF को प्रस्तुत करता है, जो एक स्केलेबल ट्रांसफॉर्मर आर्किटेक्चर वाला एक एंड-टू-एंड फ्रेमवर्क है जो हेट्रोजेनियस ग्राफ्स पर बिलियन-पैरामीटर फाउंडेशन मॉडल्स के सफल प्रशिक्षण को सक्षम बनाता है, जो मौजूदा बेसलाइन्स की तुलना में प्रेडिक्टेबल न्यूरल स्केलिंग लॉज़ और विविध डाउनस्ट्रीम टास्क केAcross श्रेष्ठ प्रदर्शन प्रदर्शित करता है।

Maya Bechler-Speicher, Yoel Gottlieb, Andrey Isakov, David Abensur, Ami Tavory, Daniel Haimovich, Ido Guy, Udi Weinsberg2026-05-22