🔬 physics

Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations

यह शोध पत्र सामाजिक-पर्यावरणीय जलवायु अंतःक्रियाओं को अनुकरण करने के लिए एकीकृत मूल्यांकन मॉडलों (Integrated Assessment Models) के भीतर मल्टी-एजेंट सुदृढीकरण लर्निंग (multi-agent Reinforcement Learning) के उपयोग का अन्वेषण करता है, जिसमें यह पाया गया है कि जबकि सहकारी एजेंट वांछनीय निम्न-कार्बन भविष्य के पथों को सफलतापूर्वक निर्धारित कर सकते हैं, प्रतिस्पर्धी गतिशीलता अक्सर इन परिणामों में बाधा डालती है, जिसके लिए एल्गोरिदम संबंधी सीमाओं को संबोधित करने हेतु आगे के नीतिगत अर्थ और अनुसंधान की आवश्यकता है।

James Rudd-Jones, Fiona Thendean, María Pérez-Ortiz2026-05-29
🤖 AI

Jailbreaking and Mitigation of Vulnerabilities in Large Language Models

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स (LLMs) में कमजोरियों की वर्तमान स्थिति की समीक्षा करता है, जो विशेष रूप से जेलब्रेकिंग और प्रॉम्प्ट इंजेक्शन हमलों पर केंद्रित है, साथ ही LLM सुरक्षा और सुरक्षित परिनियोजन को बढ़ाने के लिए मौजूदा रक्षा रणनीतियों, मूल्यांकन मेट्रिक्स और भविष्य की अनुसंधान दिशाओं का विश्लेषण करता है।

Benji Peng, Hanxuan Chen, Keyu Chen, Qian Niu, Ziqian Bi, Ming Liu, Pohsun Feng, Tianyang Wang, Lawrence K. Q. Yan, Yizh (…)2026-05-29
🤖 machine learning

A Composable Multimodal Framework for cine CMR-Text-Driven Prediction of Heart Failure Outcomes

यह शोध पत्र एक कंपोज़ेबल मल्टीमॉडल ढांचे का प्रस्ताव और मूल्यांकन करता है जो हृदय विफलता (हार्ट फेल्योर) के परिणामों की भविष्यवाणी करने और व्यक्तिगत उपचार योजनाओं को अनुकूलित करने में बेहतर सटीकता प्राप्त करने के लिए सिने कार्डियक मैग्नेटिक रेजोनेंस इमेजिंग, संरचित नैदानिक मेट्रिक्स और असंरचित पाठ्य अभिलेखों को एकीकृत करता है।

Jianzhou Chen, Jinyang Sun, Xiumei Wang, Xi Chen, Heyu Chu, Guo Song, Yuji Luo, Xingping Zhou, Rong Gu2026-05-29
⚡ electrical engineering

Weakly Supervised Detection and Temporal Localization of Whale Calls in Long-Duration Bioacoustic Data

यह शोध पत्र DSMIL-LocNet को प्रस्तुत करता है, जो एक कमजोर रूप से पर्यवेक्षित (weakly supervised) मल्टीपल इंस्टेंस लर्निंग फ्रेमवर्क है जो केवल रिकॉर्डिंग-स्तरीय उपस्थिति/अनुपस्थिति लेबल का उपयोग करके लंबी अवधि की बायोअकौस्टिक रिकॉर्डिंग्स में व्हेल कॉल्स के वर्गीकरण और सटीक टेम्पोरल लोकलाइजेशन (temporal localization) को सक्षम बनाता है, जिससे यह उन पूर्णतः पर्यवेक्षित (fully supervised) विधियों की स्केलेबिलिटी सीमाओं को दूर करता है जिनमें विस्तृत फ्रेम-स्तरीय एनोटेशन की आवश्यकता होती है।

Ragib Amin Nihal, Benjamin Yen, Runwu Shi, Takeshi Ashizawa, Kazuhiro Nakadai2026-05-29
💬 NLP

Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies

यह शोध पत्र ऑस्ट्रेलियाई चुनाव फेसबुक विज्ञापनों पर फाइन-ट्यून किए गए एक हल्के, अत्याधुनिक मॉडल को प्रस्तुत करता है जो फंडिंग, जनसांख्यिकी और समय के माध्यम से विशिष्ट अनुनय रणनीतियों (persuasion strategies) को प्रकट करने के लिए है, जिससे डिजिटल अभियानों में पारदर्शिता और मतदाता जागरूकता बढ़ती है।

Elyas Meguellati, Stefano Civelli, Pietro Bernardelle, Shazia Sadiq, Irwin King, Gianluca Demartini2026-05-29
⚡ electrical engineering

Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio

यह सर्वेक्षण एकल-चैनल बहु-वक्ता स्वचालित भाषण पहचान (मोनोरल मल्टी-स्पीकर एएसआर) के लिए एंड-टू-एंड न्यूरल दृष्टिकोणों की एक व्यापक समीक्षा और व्यवस्थित वर्गीकरण प्रदान करता है, जो वास्तुशिल्प प्रतिमानों, हालिया एल्गोरिदम सुधारों, दीर्घ-रूप भाषण विस्तारों और बेंचमार्क प्रदर्शन का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Xinlu He, Jacob Whitehill2026-05-29
🤖 AI

Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives

यह शोध पत्र यह प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स के लिए वर्तमान पे-पर-टोकन (प्रति-टोकन भुगतान) मूल्य निर्धारण मॉडल प्रदाताओं के लिए टोकन की संख्या को गलत तरीके से बताने और उपयोगकर्ताओं से अधिक शुल्क लेने के लिए एक वित्तीय प्रोत्साहन पैदा करता है, जो पारदर्शिता संबंधी आवश्यकताओं के बावजूद बनी रहने वाली एक भेद्यता है, लेकिन इसे कैरेक्टर-काउंट-आधारित (वर्ण-गणना-आधारित) मूल्य निर्धारण तंत्र को अपनाकर कम किया जा सकता है जो प्रदाताओं के लिए लाभदायक बना रहता है।

Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez2026-05-29
🤖 AI

EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance

EPiC एक कुशल कैमरा नियंत्रण ढांचा है जो पहले फ्रेम की विज़िबिलिटी मास्किंग के माध्यम से सटीक एंकर वीडियो उत्पन्न करके त्रुटि-प्रवण पॉइंट क्लाउड और पोज़ अनुमान की आवश्यकता को समाप्त करता है, जिससे अत्याधुनिक प्रदर्शन के साथ सुदृढ़ और पैरामीटर-हल्का कैमरा-निर्देशित वीडियो जनरेशन सक्षम होता है।

Zun Wang, Jaemin Cho, Jialu Li, Han Lin, Jaehong Yoon, Yue Zhang, Mohit Bansal2026-05-29
🤖 AI

PersonaAgent: Bridging Memory and Action for Personalized LLM Agents

यह शोध पत्र PersonaAgent प्रस्तुत करता है, जो एक नवीन ढांचा है जो गतिशील उपयोगकर्ता व्यक्तित्वों (dynamic user personas) द्वारा निर्देशित व्यक्तिगत स्मृति और क्रिया मॉड्यूल को एकीकृत करके लार्ज लैंग्वेज मॉडल एजेंटों को उन्नत करता है, जिससे एक टेस्ट-टाइम ऑप्टिमाइज़ेशन रणनीति के माध्यम से बेहतर वास्तविक समय प्राथमिकता संरेखण और अनुकूलित प्रदर्शन प्राप्त होता है।

Weizhi Zhang, Xinyang Zhang, Chenwei Zhang, Liangwei Yang, Jingbo Shang, Zhepei Wei, Henry Peng Zou, Zijie Huang, Zhengy (…)2026-05-29
🤖 AI

Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning

यह स्थिति पत्र (position paper) तर्क देता है कि टेक्स्ट एम्बेडिंग अनुसंधान को भाषाई रूप से आधारित डेटा, गहरे मूल्यांकन बेंचमार्क और एक मुख्य मॉडलिंग उद्देश्य को अपनाकर सतही अर्थों (surface-level semantics) से हटकर निहित अर्थों—जैसे कि प्रासंगिकता (pragmatics) और वक्ता के इरादे—को पकड़ने पर अपना ध्यान केंद्रित करना चाहिए जो वास्तविक दुनिया की भाषाई जटिलता को बेहतर ढंग से प्रतिबिंबित करता हो।

Yiqun Sun, Qiang Huang, Anthony K. H. Tung, Jun Yu2026-05-29