💬 NLP

Ad Headline Generation using Self-Critical Masked Language Model

यह शोध पत्र ट्रांसफॉर्मर-आधारित मास्क्ड लैंग्वेज मॉडल्स पर रीइन्फोर्समेंट लर्निंग पॉलिसी ग्रेडिएंट विधियों को लागू करके उच्च गुणवत्ता वाले ई-कॉमर्स विज्ञापन हेडलाइन्स उत्पन्न करने के लिए एक नवीन प्रोग्रामेटिक समाधान प्रस्तावित करता है, जो व्याकरण संबंधी शुद्धता और रचनात्मक गुणवत्ता दोनों में मौजूदा मॉडल्स और मानव-निर्मित हेडलाइन्स से बेहतर प्रदर्शन करता है।

Yashal Shakti Kanungo, Sumit Negi, Aruna Rajan2026-07-09
🤖 AI

Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics

यह शोध पत्र एक ReAct-शैली के एजेंटिक फ्रेमवर्क का प्रस्ताव और मूल्यांकन करता है जो लार्ज लैंग्वेज मॉडल्स को SageMath और अद्यतित दस्तावेज़ीकरण के साथ एकीकृत करता है, यह प्रदर्शित करते हुए कि ऐसे CAS-संवर्धित एजेंट RealMath बेंचमार्क के अनुसंधान-स्तरीय गणितीय समस्याओं पर प्रदर्शन में काफी सुधार करते हैं और ओपन-वेट एवं क्लोज्ड मॉडल्स के बीच के अंतर को कम करते हैं।

Pavel Snopov, German Magai2026-07-09
🤖 AI

The Harness Effect: How Orchestration Design Sets the Token Economics of Enterprise Agentic AI

यह शोध पत्र तर्क देता है कि एंटरप्राइज एजेंटिक एआई (Agentic AI) लागतों को नियंत्रित करने के लिए मॉडल चयन की तुलना में ऑर्केस्ट्रेशन लेयर (जिसे "हार्नेस" कहा जाता है) को अनुकूलित करना अधिक महत्वपूर्ण है, जो एक नियंत्रित अध्ययन के माध्यम से प्रदर्शित करता है कि एक बेहतर हार्नेस विविध मॉडलों में कार्य की गुणवत्ता को बनाए रखते हुए या उसमें सुधार करते हुए टोकन उपयोग को 38% और लागत को 41% तक कम कर सकता है।

Muayad Sayed Ali, Aliaksandra Novik, Anji Boddupally, Artem Yavorskyi, Chris Nickerson, Daniel Rica, Emily DuGranrut, Fe (…)2026-07-09
🤖 AI

Grounding Spatial Relations in a Compact World Model: Instruction Leakage and a Goal-Free Dynamics Fix

यह शोध पत्र प्रकट करता है कि लक्ष्य-सशर्त कॉम्पैक्ट वर्ल्ड मॉडल अक्सर "इंस्ट्रक्शन लीकेज" के कारण स्थानिक संबंधों को वास्तविक रूप से स्थापित करने में विफल रहते हैं, जहाँ मॉडल दृश्य को समझने के बजाय केवल लक्ष्य को ट्रांसक्राइब (प्रतिलिखित) कर देता है, और एक ऐसे समाधान का प्रस्ताव करता है जो वास्तविक, निर्देश-स्वतंत्र ग्राउंडिंग को बहाल करने के लिए लक्ष्य को डायनेमिक्स से अलग करता है।

Yufeng Wang, Lu Wei, Haibin Ling2026-07-09
💬 NLP

Comprehensive Evaluation of Large Language Model Responses: A Multi-Factor Scoring System

यह शोध पत्र एक व्यापक, बहु-कारक स्कोरिंग प्रणाली को एक ग्राफिकल इंटरफ़ेस के साथ प्रस्तावित करता है जो सटीकता और सुसंगतता जैसे आयामों पर लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए है, जो TruthfulQA डेटासेट पर उनकी तर्क क्षमता और तथ्यात्मक सीमाओं को उजागर करते हुए भविष्य के मॉडल परिशोधन के लिए एक पारदर्शी ढांचा प्रदान करता है।

Yiming Gai, Junde Lu, Xuefei Huang2026-07-09
🤖 AI

End-to-End LLM Flight Planning with RAG-based Memory and Multi-modal Coach Agent

यह शोध पत्र FRAMe को पेश करता है, जो eVTOL विमानों के लिए एक एंड-टू-एंड LLM-आधारित उड़ान योजना प्रणाली है, जो प्राकृतिक भाषा निर्देशों को सुरक्षित और कुशल मार्गों में अनुवाद करने के लिए एक मल्टी-मोडल कोच एजेंट और RAG-आधारित मेमोरी को एकीकृत करती है जो मानव ऑपरेटर की प्राथमिकताओं के अनुरूप होते हैं, और विविध परिदृश्यों में 93.8% तक वैधता प्राप्त करती है।

Amin Tabrizian, Arsyi Aziz, Aarifah Ullah, Mahyar Ghazanfari, Pouria Razzaghi, Peng Wei2026-07-09
🤖 machine learning

Multimodal Spatiotemporal-Frequency Fusion with Peak Enhancement for Cellular Traffic Forecasting

यह शोध पत्र MSPF-Net का प्रस्ताव करता है, जो एक मल्टीमॉडल फ्रेमवर्क है जो स्पैटियोटेम्पोरल-फ्रीक्वेंसी विश्लेषण, बर्स्ट डिटेक्शन के लिए पीक एन्हांसमेंट, और न्यूज़ कॉन्टेक्स्ट एनकोडिंग को एकीकृत करता है ताकि अंतर्निहित गतिकी (intrinsic dynamics) और बहिर्जात शहरी घटनाओं (exogenous urban events) को संयुक्त रूप से मॉडल करके सेलुलर ट्रैफ़िक पूर्वानुमान की सटीकता में महत्वपूर्ण सुधार किया जा सके।

Qingzhong Li, Yue Hu, Hui Ma, Yajun Zhang, Xinjun Pei, Ming Yan, Fei Xing2026-07-09
🤖 AI

Operational Reframing and Approval-Framed Delegation in Multi-Agent LLM Safety

यह शोध पत्र तर्क देता है कि मल्टी-एजेंट एलएलएम (LLM) सुरक्षा मूल्यांकनों को एक नियंत्रित कंट्रास्ट डिज़ाइन (controlled contrast design) को अपनाकर समग्र "पाइपलाइन प्रभावों" (pipeline effects) से आगे बढ़ना चाहिए जो परिचालन पुनर्गठन (operational reframing), योजनाकार इनकार (planner refusal) और अनुमोदन-फ्रेमयुक्त प्रतिनिधिमंडल (approval-framed delegation) को अलग-अलग मापता है, जिससे यह प्रकट होता है कि ये विशिष्ट तंत्र मॉडलों में अप्रत्याशित रूप से परस्पर क्रिया करते हैं और अक्सर मानक मूल्यांकनों में महत्वपूर्ण सुरक्षा जोखिमों को छिपा देते हैं।

Lifei Liu, Haoran Yu, Xiaochong Jiang, Su Wang, Pin Qian, Yihang Chen2026-07-09
🤖 AI

GeoProp: Grounding Robot State in Vision for Generalist Manipulation

GeoProp एक हल्का, प्लग-एंड-प्ले एडॉप्टर है जो ज्यामितीय प्रक्षेपण (geometric projection) और स्थानिक नमूनाकरण (spatial sampling) के माध्यम से प्रोप्रियोसेप्टिव अवस्था को विज़ुअल फीचर्स में स्पष्ट रूप से ग्राउंड करके सामान्यवादी रोबोटिक हेरफेर (robotic manipulation) को बढ़ाता है, जो न्यूनतम पैरामीटर ओवरहेड के साथ सिमुलेशन और वास्तविक दुनिया के कार्यों में नीति प्रदर्शन (policy performance) में महत्वपूर्ण सुधार करता है।

Guoyang Zhao, Quanhao Qian, Gongjie Zhang, Wenhao Li, Jiuniu Wang, Xiaowei Lu, Deli Zhao, Ran Xu2026-07-09
🤖 AI

Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning

यह शोध पत्र टेक्स्ट-टू-इमेज इन-कॉन्टेक्स्ट लर्निंग के लिए एक ट्री-ऑफ-थॉट्स रीजनिंग फ्रेमवर्क का प्रस्ताव करता है जो अतिरिक्त प्रशिक्षण की आवश्यकता के बिना संरचनात्मक अस्पष्टता को हल करने और छवि संश्लेषण की गुणवत्ता में सुधार करने के लिए एक बहु-चरणीय पीढ़ी, मूल्यांकन और चयन प्रक्रिया का उपयोग करता है।

Stepanida Alekseeva, Jenifer Kalafatovich, Seong-Whan Lee2026-07-09