💻 computer science

Leveraging Multimodal LLMs for Built Environment and Housing Attribute Assessment from Street-View Imagery

यह शोध पत्र एक ऐसे नवीन ढांचे को प्रस्तुत करता है जो गूगल स्ट्रीट व्यू इमेजरी का उपयोग करके देश भर में इमारतों की स्थिति और आवास संबंधी विशेषताओं का स्वचालित और कुशलतापूर्वक मूल्यांकन करने के लिए फाइन-ट्यून्ड और डिस्टिल्ड मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे मानव रेटर्स के समान उच्च सटीकता प्राप्त होती है और साथ ही कंप्यूटिंग लागत और लेबलिंग प्रयास में उल्लेखनीय कमी आती है।

Siyuan Yao, Siavash Ghorbany, Kuangshi Ai, Arnav Cherukuthota, Meghan Forstchen, Alexis Korotasz, Matthew Sisk, Ming Hu (…)2026-04-24
💬 NLP

Cross-Session Threats in AI Agents: Benchmark, Evaluation, and Algorithms

यह शोधपत्र CSTM-Bench प्रस्तुत करता है, जो उन क्रॉस-सेशन AI एजेंट खतरों का पता लगाने के लिए एक डेटासेट और मूल्यांकन ढांचा है जो मेमोरीलेस गार्डरेल्स (memoryless guardrails) से बच निकलते हैं, यह प्रदर्शित करते हुए कि बाउंडेड-मेमोरी कोसेट रीडर्स (bounded-memory Coreset Readers), सेशन-बाउंड और फुल-लॉग अप्रोच दोनों से बेहतर प्रदर्शन करते हैं और एक नया मीट्रिक प्रस्तावित करते हैं जो डिटेक्शन रिकॉल को सर्विंग स्टेबिलिटी (serving stability) के साथ संतुलित करता है।

Ari Azarafrooz2026-04-24
💬 NLP

Enhancing Science Classroom Discourse Analysis through Joint Multi-Task Learning for Reasoning-Component Classification

यह शोध पत्र एक स्वचालित विमर्श विश्लेषण प्रणाली प्रस्तुत करता है जो विज्ञान कक्षाओं में शिक्षक और छात्र के तर्क पैटर्न को वर्गीकृत करने के लिए संयुक्त बहु-कार्य शिक्षण (joint multi-task learning) और LLM-आधारित सिंथेटिक डेटा संवर्धन का लाभ उठाती है, जो अंततः यह प्रकट करती है कि 'शिक्षक फीडबैक-विद-क्वेश्चन' मूव्स, छात्र के अनुमानात्मक तर्क के सबसे सुसंगत भविष्यवक्ता हैं।

Jiho Noh, Mukhesh Raghava Katragadda, Raymond Carl, Soon Lee2026-04-24
💻 computer science

Navigating the Clutter: Waypoint-Based Bi-Level Planning for Multi-Robot Systems

यह शोध पत्र एक हाइब्रिड मल्टी-रोबोट नियंत्रण ढांचे का प्रस्ताव करता है जो पथ (trajectory) प्रतिनिधित्व के लिए वेपॉइंट्स (waypoints) और मोशन व्यवहार्यता फीडबैक को प्रसारित करने के लिए एक करिकुलम-आधारित RLVR प्रशिक्षण रणनीति पेश करके अव्यवस्थित वातावरण में कार्य और गति नियोजन (task and motion planning) को संयुक्त रूप से अनुकूलित करता है, जो मौजूदा बेसलाइनों की तुलना में BoxNet3D-OBS बेंचमार्क पर बेहतर कार्य सफलता प्रदर्शित करता है।

Jiabao Ji, Yongchao Chen, Yang Zhang, Ramana Rao Kompella, Chuchu Fan, Gaowen Liu, Shiyu Chang2026-04-24
💬 NLP

Using Machine Mental Imagery for Representing Common Ground in Situated Dialogue

यह शोध पत्र एक सक्रिय दृश्य स्कैफोल्डिंग (visual scaffolding) ढांचे का प्रस्ताव करता है जो संवाद के निरंतर दृश्य इतिहास बनाने के लिए मानसिक चित्रण (mental imagery) का लाभ उठाता है, जो वर्णनात्मक और प्रस्तावात्मक सूचनाओं को जोड़कर "प्रतिनिधित्व धुंधलेपन" (representational blur) को प्रभावी ढंग से कम करता है और स्थित संवादों में सामान्य आधार (common ground) के रखरखाव में सुधार करता है।

Biswesh Mohapatra, Giovanni Duca, Laurent Romary, Justine Cassell2026-04-24
💬 NLP

Adaptive Instruction Composition for Automated LLM Red-Teaming

यह शोध पत्र अडैप्टिव इंस्ट्रक्शन कंपोज़िशन (Adaptive Instruction Composition) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो क्राउडसोर्स्ड हानिकारक प्रश्नों और युक्तियों को गतिशील रूप से संयोजित करने के लिए सुदृढीकरण लर्निंग-आधारित कॉन्टेक्स्टुअल बैंडिट (reinforcement learning-based contextual bandit) का उपयोग करता है, जिससे विविध और अत्यधिक प्रभावी एलएलएम (LLM) जेलब्रेक उत्पन्न होते हैं जो रैंडम और मौजूदा अडैप्टिव रेड-टीमिंग दृष्टिकोणों दोनों से बेहतर प्रदर्शन करते हैं।

Jesse Zymet, Andy Luo, Swapnil Shinde, Sahil Wadhwa, Emily Chen2026-04-24
💻 computer science

Scaling of Gaussian Kolmogorov--Arnold Networks

यह शोध पत्र यह स्थापित करता है कि गॉसियन कोलमोगोरोव-आर्नोल्ड नेटवर्क में गॉसियन स्केल पैरामीटर ϵ\epsilon मुख्य रूप से पहली परत की फीचर ज्यामिति (feature geometry) द्वारा नियंत्रित होता है, और एक व्यावहारिक ऑपरेटिंग अंतराल ϵ∈[1G−1,2G−1]\epsilon \in [\frac{1}{G-1}, \frac{2}{G-1}] का प्रस्ताव करता है जो विभिन्न आर्किटेक्चर और अनुप्रयोगों में स्थिरता और प्रतिस्पर्धात्मकता सुनिश्चित करने के लिए एक सुदृढ़ डिज़ाइन नियम के रूप में कार्य करता है।

Amir Noorizadegan, Sifan Wang2026-04-24
💻 computer science

Trust but Verify: Introducing DAVinCI -- A Framework for Dual Attribution and Verification in Claim Inference for Language Models

यह शोध पत्र DAVinCI को प्रस्तुत करता है, जो एक दो-चरणीय ढांचा है जो दावों के आंतरिक और बाहरी स्रोतों के दोहरे एट्रिब्यूशन को एंटेलमेंट-आधारित सत्यापन के साथ जोड़कर लार्ज लैंग्वेज मॉडल्स की तथ्यात्मक विश्वसनीयता और व्याख्यात्मकता को बढ़ाता है, जिसके परिणामस्वरूप उच्च-जोखिम वाले डोमेन में सटीकता और जवाबदेही में महत्वपूर्ण सुधार होता है।

Vipula Rawte, Ryan Rossi, Franck Dernoncourt, Nedim Lipka2026-04-24
💻 computer science

SQLyzr: A Comprehensive Benchmark and Evaluation Platform for Text-to-SQL

यह शोध पत्र SQLyzr को प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन मंच है जो विविध मेट्रिक्स, यथार्थवादी वर्कलोड संरेखण और सूक्ष्म नैदानिक उपकरण प्रदान करके मौजूदा टेक्स्ट-टू-SQL मूल्यांकनों की सीमाओं को संबोधित करता है ताकि लार्ज लैंग्वेज मॉडल-आधारित टेक्स्ट-टू-SQL सिस्टम के क्रमिक सुधार को सुगम बनाया जा सके।

Sepideh Abedini, M. Tamer Özsu2026-04-24
📈 economics

Post-AGI Economies: Autonomy and the First Fundamental Theorem of Welfare Economics

यह शोध पत्र तर्क देता है कि कल्याणकारी अर्थशास्त्र के प्रथम मौलिक प्रमेय को उत्तर-AGI अर्थव्यवस्थाओं में वैध बने रहने के लिए स्वायत्तता संबंधी योग्यता की आवश्यकता है, जो एक सामान्यीकृत मॉडल का प्रस्ताव करता है जहाँ प्रतिस्पर्धी संतुलन केवल कृत्रिम प्रणालियों द्वारा प्रदर्शित स्वायत्तता के विभिन्न स्तरों को ध्यान में रखने पर ही पारेटो दक्षता प्राप्त करता है।

Elija Perrier2026-04-24