🤖 machine learning

Rethinking Layer Redundancy in Large Language Models: Calibration Objectives and Search for Depth Pruning

यह शोध पत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स में लेयर रिडंडेंसी (परत अतिरेक) एक अंतर्निहित संरचनात्मक गुण नहीं है बल्कि यह कैलिब्रेशन उद्देश्य पर कार्यात्मक रूप से निर्भर है, जो यह प्रदर्शित करता है कि विशिष्ट सर्च एल्गोरिदम के उपयोग की तुलना में उद्देश्य का चयन डेप्थ प्रूनिंग परिणामों पर अधिक प्रभाव डालता है।

Minkyu Kim, Vincent-Daniel Yun, Youngrae Kim, Youngjin Heo, Suin Cho, Seong-hun Kim, Woosang Lim, Gaeul Kwon2026-04-29
🤖 machine learning

Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligence

नेमोट्रोन 3 नैनो ओम्नी (Nemotron 3 Nano Omni) एक नया ओपन-सोर्स मल्टीमॉडल मॉडल है जो मूल रूप से ऑडियो, टेक्स्ट, इमेज और वीडियो इनपुट का समर्थन करता है, जो 30B-A3B बैकबोन और टोकन-रिडक्शन तकनीकों के माध्यम से बेहतर सटीकता, एजेंटिक क्षमताएं और कुशल इन्फरेंस प्रदान करता है, जिसके चेकपॉइंट्स और कोड को आगे के अनुसंधान के समर्थन के लिए जारी किया गया है।

NVIDIA, :, Amala Sanjay Deshmukh, Kateryna Chumachenko, Tuomas Rintamaki, Matthieu Le, Tyler Poon, Danial Mohseni Taher (…)2026-04-29
💬 NLP

BenchGuard: Who Guards the Benchmarks? Automated Auditing of LLM Agent Benchmarks

यह शोधपत्र बेंचगार्ड (BenchGuard) को प्रस्तुत करता है, जो एक स्वचालित ऑडिटिंग फ्रेमवर्क है जो टास्क-ओरिएंटेड एजेंट बेंचमार्क में दोषों को व्यवस्थित रूप से पहचानने और उन्हें मान्य करने के लिए फ्रंटियर एलएलएम (LLM) का लाभ उठाता है, जो कम लागत पर मानवीय समीक्षा द्वारा छूट जाने वाली महत्वपूर्ण त्रुटियों का पता लगाने में इसकी प्रभावशीलता को प्रदर्शित करता है।

Xinming Tu (Minta), Tianze Wang (Minta), Yingzhou (Minta), Lu, Kexin Huang, Yuanhao Qu, Sara Mostafavi2026-04-29
🤖 machine learning

Compute Aligned Training: Optimizing for Test Time Inference

यह शोध पत्र "कंप्यूट अलाइन्ड ट्रेनिंग" (Compute Aligned Training) पेश करता है, जो एक नया फ्रेमवर्क है जो नए लॉस फंक्शन्स को व्युत्पन्न करके लार्ज लैंग्वेज मॉडल्स के ट्रेनिंग ऑब्जेक्टिव्स को टेस्ट-टाइम इन्फरेंस रणनीतियों के साथ संरेखित करता है, जिससे मानक SFT और RL दृष्टिकोणों की तुलना में प्रदर्शन स्केलिंग में महत्वपूर्ण सुधार होता है।

Adam Ousherovitch, Ambuj Tewari2026-04-29
💻 computer science

Assessing Y-Axis Influence: Bias in Multimodal Language Models on Chart-to-Table Translation

यह शोध पत्र FairChart2Table फ्रेमवर्क को प्रस्तुत करता है जो यह प्रकट करता है कि मल्टीमॉडल लैंग्वेज मॉडल्स चार्ट-टू-टेबल अनुवाद में y-अक्ष की विशेषताओं (जैसे अंक की लंबाई, टिक संख्या और मान सीमा) और लेजेंड जटिलता से संबंधित महत्वपूर्ण प्रदर्शन पूर्वाग्रह प्रदर्शित करते हैं, जबकि यह भी दर्शाता है कि स्पष्ट y-अक्ष जानकारी प्रदान करने से इन असमानताओं को कम किया जा सकता है।

Seok Hwan Song, Azher Ahmed Efat, Wallapak Tavanapong2026-04-29
💬 NLP

Leverage Laws: A Per-Task Framework for Human-Agent Collaboration

यह शोध पत्र मानव-एजेंट सहयोग के लिए एक मानदण्डिक "लीवरेज रेशियो" (leverage ratio) ढांचे का प्रस्ताव करता है जो विस्थापित मानव कार्य की तुलना विशिष्टता (specification), व्यवधान समाधान और समीक्षा की समय लागत से करके दक्षता को परिमाणित करता है, जबकि यह विश्लेषण करता है कि सूचना प्रवाह संबंधी बाधाएं और कार्य की नवीनता कैसे प्रति-कार्य और विंडो आधारित लीवरेज स्केलिंग को सीमित करती हैं।

Stan Loosmore2026-04-29
💻 computer science

Barriers and Enablers of Online Instruction in Hospitality Education in the Philippines: An Exploratory Study

फिलीपीन आतिथ्य (हॉस्पिटैलिटी) शिक्षकों के इस अन्वेषणात्मक अध्ययन ने ऑनलाइन निर्देश को प्रभावित करने वाले प्रमुख कारकों के रूप में शैक्षणिक चुनौतियों, तकनीकी बाधाओं और संस्थागत सहायता की पहचान की है, जबकि शैक्षिक परिणामों को बेहतर बनाने के लिए उन्नत प्रशिक्षण और जिम्मेदार एआई (AI) एकीकरण की आवश्यकता पर भी प्रकाश डाला है।

Maria Anna D. Cruz, Jeaneth D. Serna, Lloyd D. Feliciano, Mike Haizon M. David, Ma. Ferna Bel L. Punsalan, Glen Brian L. (…)2026-04-29
💬 NLP

Analyzing LLM Reasoning to Uncover Mental Health Stigma

यह शोध पत्र एक नवीन ढांचे का प्रस्ताव करता है जो केवल उनके अंतिम आउटपुट के बजाय बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के मध्यवर्ती तर्क चरणों का विश्लेषण करता है, ताकि उस छिपे हुए मानसिक स्वास्थ्य कलंक (मेंटल हेल्थ स्टिग्मा) को उजागर और वर्गीकृत किया जा सके जिसे पारंपरिक बहुविकल्पीय मूल्यांकन पकड़ने में विफल रहते हैं।

Sreehari Sankar, Aliakbar Nafar, Mona Barman, Hannah K. Heitz, Ashwin Kumar, Pouria Tohidi, Dailun Li, Danish Hussain, R (…)2026-04-29
💻 computer science

Agentic Architect: An Agentic AI Framework for Architecture Design Exploration and Optimization

एजेंटिक आर्किटेक्ट (Agentic Architect) एक नवीन ओपन-सोर्स फ्रेमवर्क है जो कोड विकास और साइकिल-एक्यूरेट सिमुलेशन के माध्यम से कंप्यूटर आर्किटेक्चर डिजाइनों को स्वायत्त रूप से खोजने और अनुकूलित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो कैश रिप्लेसमेंट, ब्रांच प्रेडिक्शन और डेटा प्रीफेचिंग में अत्याधुनिक प्रदर्शन सुधार प्राप्त करता है और यह प्रदर्शित करता है कि इस प्रक्रिया के लिए मानवीय मार्गदर्शन और सीड की गुणवत्ता महत्वपूर्ण बनी हुई है।

Alexander Blasberg, Vasilis Kypriotis, Dimitrios Skarlatos2026-04-29
💬 NLP

Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest

यह शोध पत्र 'कोऑपरेट टू कम्पलीट' (C2C) को प्रस्तुत करता है, जो मिश्रित-अभिप्रेरणा वाले परिवेशों में रणनीतिक समन्वय का अध्ययन करने के लिए डिज़ाइन किया गया एक मल्टी-एजेंट वातावरण है, जो निजी वार्ताओं में मनुष्यों और भाषा मॉडल एजेंटों के बीच प्रमुख व्यवहार संबंधी अंतरों को उजागर करता है और यह प्रदर्शित करता है कि कैसे लक्षित प्रॉम्प्टिंग एआई की जीत की दर में महत्वपूर्ण सुधार कर सकती है।

Abigail O'Neill, Alan Zhu, Mihran Miroyan, Narges Norouzi, Joseph E. Gonzalez2026-04-29