🤖 AI

Lomekwi: Resource-Bounded Tool Discovery in LLM Agents

यह शोधपत्र एक संज्ञानात्मक विज्ञान से प्रेरित ढांचे का प्रस्ताव करता है जो टूल डिस्कवरी (उपकरण खोज) को जिज्ञासा, पहचान और दक्षता में विभाजित करता है, जो कॉम्बिनेटोरियल गेम्स और वास्तविक दुनिया के कार्य परिवेशों के विश्लेषण के माध्यम से यह प्रकट करता है कि पहचान क्षमताएं मॉडल के आकार के साथ व्युत्क्रमानुपाती रूप से घटती हैं।

Roshan Klein-Seetharaman, Daniel Wang, Andrew Xu2026-07-21
💬 NLP

Training Continuous Chain of Thought Models: A Tale of Two Regimes

यह शोध पत्र C-MTP को प्रस्तुत करता है, जो निरंतर चेन-ऑफ-थॉट (Chain-of-Thought) मॉडलों को प्रशिक्षित करने के लिए एक तेज़ प्रत्यक्ष पर्यवेक्षण विधि है, जो पूर्ववर्ती प्रत्यक्ष दृष्टिकोणों से बेहतर प्रदर्शन करता है और लघु तर्क श्रृंखलाओं (reasoning traces) पर धीमी अप्रत्यक्ष विधियों के बराबर प्रदर्शन करता है, जबकि यह भी प्रकट करता है कि वर्तमान निरंतर CoT तकनीकें लंबी तर्क श्रृंखलाओं वाले जटिल कार्यों पर लागू होने पर काफी संघर्ष करती हैं।

Varun Yerram, He He, Eunsol Choi2026-07-21
💬 NLP

Real-World Evaluation of an AI Agent Drafting Translational Impact Summaries

यह अध्ययन प्रदर्शित करता है कि एक ह्यूमन-इन-द-लूप एआई एजेंट नैदानिक विद्वानों (क्लिनिकल स्कॉलर्स) के लिए ट्रांसलेशनल इम्पैक्ट सारांशों को एकत्र करने और ड्राफ्ट करने को प्रभावी ढंग से स्वचालित कर सकता है, जिससे उच्च सटीकता बनाए रखते हुए और अक्सर नियमित प्रक्रियाओं द्वारा छूट जाने वाले गैर-विद्वत्तापूर्ण साक्ष्यों को कैप्चर करते हुए, प्रति विद्वान रिपोर्टिंग कार्यभार को अनुमानित 15 घंटों से घटाकर 14 मिनट कर दिया गया है।

Mohammad Arvan, Amber E. Osterholt, Bailee Rue, Yuvaneswaren Ramakrishnan Sureshbabu, Krishna Riteshkumar Patel, Rebecca (…)2026-07-21
🤖 AI

PriorProof: A Point-in-Time Measure of Technique Novelty for Formal Proofs

यह शोध पत्र PriorProof को प्रस्तुत करता है, जो एक स्वचालित, ऑन्टोलॉजी-मुक्त विधि है जो लीन (Lean) में औपचारिक प्रमाण तकनीकों की नवीनता को उनके डिपेंडेंसी फुटप्रिंट्स (dependency footprints) के सरप्राइज़ल (surprisal) को एक समय-बद्ध पूर्ववर्ती (time-anchored prior) के विरुद्ध मापकर मात्रात्मक रूप से निर्धारित करता है, जो मानव विशेषज्ञों के साथ मध्यम सहमति प्रदर्शित करता है और विशेषज्ञ निर्णय के विकल्प के बजाय एक विखंडनीय (decomposable), व्याख्या योग्य संकेत के रूप में कार्य करता है।

Neel Somani2026-07-21
🤖 AI

WHALE: A Scalable Unified Model for Recommendation with Wukong-HSTU Architecture

यह शोध पत्र WHALE को प्रस्तुत करता है, जो एक स्केलेबल यूनिफाइड रिकमेंडेशन आर्किटेक्चर है जो गैर-अनुक्रमिक (non-sequence) और अनुक्रमिक (sequence) विशेषताओं को संयुक्त रूप से मॉडल करने के लिए एक नवीन फ्यूजन मैकेनिज्म के माध्यम से Wukong और HSTU बैकबोन को एकीकृत करता है, जिससे औद्योगिक उत्पादन प्रणालियों में महत्वपूर्ण ऑफलाइन और ऑनलाइन प्रदर्शन लाभ प्राप्त होते हैं।

Renqin Cai, Dawei Sun, Yuanjun Yao, Zhiyong Wang, Velvin Fu, Maggie Zhuang, Yu Shi, Zhongnan Fang, Xuan Cao, Jing Qian (…)2026-07-21
🤖 machine learning

Solver-Hard Is Not Model-Hard: A Hardness-Controlled Diagnostic for LLM Constraint Reasoning

यह शोध पत्र यह प्रदर्शित करता है कि बड़े भाषा मॉडलों का बाधा तर्क (constraint reasoning) कार्यों पर प्रदर्शन समस्या के उदाहरणों की अंतर्निहित सॉल्वर जटिलता (solver hardness) द्वारा निर्धारित नहीं होता है, जैसा कि सावधानीपूर्वक नियंत्रित, घनत्व-मिलान वाले बेंचमार्क में प्रूफ़-कठोरता प्रॉक्सी (proof-hardness proxies) और मॉडल सटीकता या टोकन व्यय के बीच सहसंबंध की कमी से सिद्ध होता है।

Lucky Verma2026-07-21
🤖 AI

EvoGUI: An Evolution-Aware Benchmark for GUI State-Transition Understanding

यह शोध पत्र EvoGUI को प्रस्तुत करता है, जो एक नैदानिक बेंचमार्क (diagnostic benchmark) है जो सामान्यीकृत प्रक्षेपवक्रों (normalized trajectories) से प्राप्त विजुअल क्वेश्चन-आंसरिंग प्रोब्स के माध्यम से GUI एजेंटों की स्टेट-ट्रांजिशन समझ का मूल्यांकन करता है, जो महत्वपूर्ण प्रदर्शन अंतराल और मॉडल के पैमाने तथा इस विशिष्ट क्षमता के बीच सहसंबंध की कमी को प्रकट करता है।

Yaohan Yang, Minglei Shi, Borui Zhang, Jie Zhou, Jiwen Lu2026-07-21
🤖 AI

Bridging the Information Gap: Semantic Densification and Hindsight Distillation for Cold-Start Prediction

यह शोध पत्र SemRaD का प्रस्ताव देता है, जो एक ऐसा फ्रेमवर्क है जो शोर युक्त (noisy) LLM तर्क (rationales) को संरचित अर्थ संबंधी प्रोफाइल्स (structured semantic profiles) से बदलकर और विशेषाधिकार प्राप्त शिक्षकों (privileged teachers) तथा विरल छात्रों (sparse students) के बीच सूचना अंतराल को पश्चदृष्टि-जागरूक आसवन (hindsight-aware distillation) के माध्यम से पाटकर कोल्ड-स्टार्ट भविष्यवाणी की चुनौतियों का समाधान करता है, जिससे औद्योगिक डेटासेट पर LTV और CVR में महत्वपूर्ण सुधार प्राप्त होता है।

Hao Duong Le, Yifei Gao, Huan Li, Lun Jiang, Chen Bai, Ke Xing, Chen Zhang2026-07-21
🤖 AI

ThAME: 3D Memory-Enabled Heterogeneous Accelerator for LLM Mixture of Experts

ThAME एक 3D हेट्रोजेनियस मल्टी-चिपलेट एक्सेलेरेटर है जो Mixture of Experts इन्फरेंस की मेमोरी बैंडविड्थ, रूटिंग और लेटेंसी बाधाओं को दूर करने के लिए FeFET और DRAM मेमोरी इंटीग्रेशन के साथ एक सह-डिज़ाइन किए गए कंप्यूट मैपिंग और विशेष नेटवर्क-ऑन-चिप का लाभ उठाता है, जिससे अत्याधुनिक समाधानों की तुलना में 15.7x तक की गति वृद्धि और 9.8x ऊर्जा दक्षता में सुधार प्राप्त होता है।

Pratyush Dhingra, Pramit Kumar Pal, Janardhan Rao Doppa, Partha Pratim Pande2026-07-21
🤖 AI

ALLUDE: A Unified Evaluation System for Configurable Attacks in Differentiable Environments

यह शोधपत्र ALLUDE को प्रस्तुत करता है, जो एक क्रॉस-प्लेटफ़ॉर्म, एकीकृत मूल्यांकन प्रणाली है जो विविध दृश्यों, मौसम की स्थितियों और कैमरा प्रक्षेप पथों के विरुद्ध विज़न मॉडल के विरुद्ध एडवरसैरियल हमलों का व्यापक रूप से आकलन और स्ट्रेस-टेस्ट करने के लिए डिफरेंशिएबल रेंडरिंग और लैटिन हाइपरक्यूब सैंपलिंग का लाभ उठाता है, जो पूर्ववर्ती कार्यों में महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है।

Mansi Phute, Alexander Greenhalgh, Matthew Hull, Haoran Wang, Alec Helbling, ShengYun Peng, Elliott Faa, Willian Lunardi (…)2026-07-21