💬 NLP

DistillGuard: Evaluating Defenses Against LLM Knowledge Distillation

यह शोध पत्र DistillGuard को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो व्यवस्थित रूप से LLM नॉलेज डिस्टिलेशन के विरुद्ध आउटपुट-लेवल डिफेंस का मूल्यांकन करता है और यह पाता है कि अधिकांश वर्तमान दृष्टिकोण काफी हद तक अप्रभावी हैं, जिसमें प्रदर्शन में गिरावट अत्यधिक कार्य-निर्भर है और ज्ञान की चोरी को व्यापक रूप से रोकने के लिए अपर्याप्त है।

Bo Jiang2026-03-10
💬 NLP

AI Steerability 360: A Toolkit for Steering Large Language Models

यह शोध पत्र AI Steerability 360 को प्रस्तुत करता है, जो एक ओपन-सोर्स, Hugging Face-नेटिव पायथन टूलकिट है जो इनपुट, स्ट्रक्चरल, स्टेट और आउटपुट कंट्रोल सरफेसेस के माध्यम से विविध लार्ज लैंग्वेज मॉडल स्टीयरिंग विधियों को कंपोज़ करने, मूल्यांकन करने और तुलना करने के लिए एक एकीकृत इंटरफ़ेस प्रदान करता है।

Erik Miehling, Karthikeyan Natesan Ramamurthy, Praveen Venkateswaran, Irene Ko, Pierre Dognin, Moninder Singh, Tejaswini (…)2026-03-10
💬 NLP

An Efficient and Effective Evaluator for Text2SQL Models on Unseen and Unlabeled Data

यह शोध पत्र FusionSQL को प्रस्तुत करता है, जो एक नवीन इवैल्यूएटर (evaluator) है जो संदर्भ लेबल (reference labels) की आवश्यकता के बिना प्रदर्शन में बदलाव का पता लगाने के लिए आउटपुट पैटर्न का विश्लेषण करके अनदेखे और अनलेबल डेटासेट पर Text2SQL मॉडलों की सटीकता का अनुमान लगाता है।

Trinh Pham, Thanh Tam Nguyen, Viet Huynh, Hongzhi Yin, Quoc Viet Hung Nguyen2026-03-10
💬 NLP

SynPlanResearch-R1: Encouraging Tool Exploration for Deep Research with Synthetic Plans

यह शोध पत्र SynPlanResearch-R1 को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो सुपरवाइज्ड फाइन-ट्यूनिंग के दौरान गहन अन्वेषण को प्रोत्साहित करने के लिए टूल-यूज़ ट्रेजेक्टरीज (tool-use trajectories) को संश्लेषित करता है, जिससे सत्यापन योग्य पुरस्कारों (verifiable rewards) के साथ सुदृढीकरण सीखने (reinforcement learning) की सीमाओं को दूर किया जा सके और कई बेंचमार्क पर रिसर्च एजेंट के प्रदर्शन में महत्वपूर्ण सुधार किया जा सके।

Hansi Zeng, Zoey Li, Yifan Gao, Chenwei Zhang, Xiaoman Pan, Tao Yang, Fengran Mo, Jiacheng Lin, Xian Li, Jingbo Shang2026-03-10
💬 NLP

What Do AI Agents Talk About? Emergent Communication Structure in the First AI-Only Social Network

यह शोध पत्र पहले केवल एआई-आधारित सोशल नेटवर्क, मोल्टबुक (Moltbook) के उभरते विमर्श का विश्लेषण करता है, जो यह प्रकट करता है कि इसके एजेंट समुदाय भावनात्मक अनुरूपता के बजाय अत्यधिक आत्मनिरीक्षण, अनुष्ठानिक संकेत और भावात्मक पुनर्निर्देशन द्वारा अभिलक्षित हैं।

Taksch Dube, Jianfeng Zhu, NHatHai Phan, Ruoming Jin2026-03-10
💬 NLP

BRIDGE: Benchmark for multi-hop Reasoning In long multimodal Documents with Grounded Evidence

यह शोध पत्र BRIDGE को प्रस्तुत करता है, जो लंबे मल्टीमॉडल वैज्ञानिक दस्तावेजों में मल्टी-हॉप रीजनिंग का मूल्यांकन करने के लिए डिज़ाइन किया गया एक नया बेंचमार्क है, जो स्टेप-लेवल एनोटेशन प्रदान करता है जो साक्ष्य एकत्रीकरण (एविडेंस एग्रीगेशन) और ग्राउंडिंग में व्यवस्थित कमियों को उजागर करता है जिन्हें पारंपरिक उत्तर-मात्र मूल्यांकनों द्वारा अनदेखा कर दिया जाता है।

Biao Xiang, Soyeon Caren Han, Yihao Ding2026-03-10
💬 NLP

Examining the Role of YouTube Production and Consumption Dynamics on the Formation of Extreme Ideologies

यह शोध पत्र 1,100 अमेरिकी प्रतिभागियों के एक अनुदैर्ध्य, मिश्रित-पद्धति अध्ययन को प्रस्तुत करता है जो यह दर्शाता है कि चरम विचारधाराओं की ओर बदलाव एक पारस्परिक गतिशीलता द्वारा संचालित होता है जहाँ उपयोगकर्ता उन चैनलों से सामग्री का उपभोग करते हैं जो तेजी से क्रोध और शिकायत से भरी सामग्री का उत्पादन करते हैं, जो बदले में वैचारिक ध्रुवीकरण को बढ़ाता है।

Sarmad Chandio, Rishab Nithyanand2026-03-10
🤖 machine learning

Deterministic Differentiable Structured Pruning for Large Language Models

यह शोध पत्र डिटरमिनिस्टिक डिफरेंशिएबल प्रूनिंग (DDP) को प्रस्तुत करता है, जो सीधे l0l_0 ऑब्जेक्टिव के एक डिटरमिनिस्टिक सॉफ्ट सरोगेट को अनुकूलित करके पूर्व स्ट्रक्चर्ड प्रूनिंग दृष्टिकोणों की ट्रेन-टेस्ट मिसमैच और स्टोकेस्टिसिटी को समाप्त करने वाली एक नवीन विधि है, जिससे उच्च स्पर्सिटी स्तरों पर Qwen3 जैसे बड़े भाषा मॉडलों पर तेज़ अभिसरण, अधिक अभिव्यक्तता और बेहतर प्रदर्शन प्रतिधारण (जैसे, ~1% हानि) प्राप्त होता है।

Weiyu Huang, Pengle Zhang, Xiaolu Zhang, Jun Zhou, Jun Zhu, Jianfei Chen2026-03-10
💬 NLP

Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS

यह शोध पत्र रामसा (Ramsa) को प्रस्तुत करता है, जो विभिन्न उप-बोलियों और विषयों के 157 वक्ताओं का एक 41-घंटे का समाजशास्त्रीय रूप से विविध अमीराती अरबी भाषण संग्रह है, जो निम्न-संसाधन एएसआर (ASR) और टीटीएस (TTS) प्रौद्योगिकियों को विकसित करने के लिए एक आधारभूत संसाधन के रूप में कार्य करता है और मौजूदा मॉडलों के लिए प्रारंभिक प्रदर्शन बेसलाइन स्थापित करता है।

Rania Al-Sabbagh2026-03-10
💬 NLP

EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery

EvoScientist एक विकसित होता हुआ मल्टी-एजेंट फ्रेमवर्क है जो निरंतर अनुसंधान रणनीतियों को परिष्कृत करने के लिए स्थायी स्मृति (persistent memory) और स्व-विकास (self-evolution) का लाभ उठाता है, जिससे यह नवीन वैज्ञानिक विचारों को उत्पन्न करने और एंड-टू-एंड खोज के लिए सफल प्रयोगों को निष्पादित करने में मौजूदा अत्याधुनिक प्रणालियों से बेहतर प्रदर्शन करता है।

Yougang Lyu, Xi Zhang, Xinhao Yi, Yuyue Zhao, Shuyu Guo, Wenxiang Hu, Jan Piotrowski, Jakub Kaliski, Jacopo Urbani, Zaiq (…)2026-03-10