🤖 AI

ACE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments

ACE-Bench एक हल्का, पुनरुत्पादनीय एजेंट मूल्यांकन बेंचमार्क है जो कार्य क्षितिज (task horizons) और कठिनाई के सूक्ष्म, नियंत्रणीय हेरफेर के लिए स्थिर JSON वातावरणों के साथ एक एकीकृत ग्रिड-आधारित योजना कार्य का उपयोग करता है, जिससे मौजूदा बेंचमार्क में प्रचलित उच्च ओवरहेड और अविश्वसनीय स्कोरिंग संबंधी समस्याओं का समाधान होता है।

Wang Yang, Chaoda Song, Xinpeng Li, Debargha Ganguly, Chuang Ma, Shouren Wang, Zhihao Dou, Yuli Zhou, Vipin Chaudhary, X (…)2026-04-08
💬 NLP

Paper Circle: An Open-source Multi-agent Research Discovery and Analysis Framework

यह शोध पत्र पेपर सर्कल (Paper Circle) को प्रस्तुत करता है, जो एक ओपन-सोर्स मल्टी-एजेंट फ्रेमवर्क है जो एकीकृत खोज और विश्लेषण पाइपलाइनों के माध्यम से शैक्षणिक अनुसंधान को सुव्यवस्थित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिसमें मल्टी-सोर्स रिट्रीवल, स्ट्रक्चर्ड नॉलेज ग्राफ जनरेशन और पुनरुत्पादक आउटपुट की विशेषताएं शामिल हैं।

Komal Kumar, Aman Chadha, Salman Khan, Fahad Shahbaz Khan, Hisham Cholakkal2026-04-08
🤖 AI

LLMs-Healthcare : Current Applications and Challenges of Large Language Models in various Medical Specialties

यह शोध पत्र कैंसर देखभाल, त्वचा विज्ञान और मानसिक स्वास्थ्य जैसे विविध चिकित्सा विशिष्टताओं में लार्ज लैंग्वेज मॉडल्स (Large Language Models) के परिवर्तनकारी अनुप्रयोगों की एक व्यापक समीक्षा प्रदान करता है, साथ ही स्वास्थ्य सेवा में इन मॉडल्स को एकीकृत करने में जुड़ी चुनौतियों, अवसरों और डेटा हैंडलिंग आवश्यकताओं का भी विश्लेषण करता है।

Ummara Mumtaz, Awais Ahmed, Summaya Mumtaz2026-04-07
💬 NLP

SPRIG: Improving Large Language Model Performance by System Prompt Optimization

यह शोध पत्र SPRIG को प्रस्तुत करता है, जो एक एडिट-आधारित जेनेटिक एल्गोरिदम है जो विविध कार्यों, मॉडल परिवारों और भाषाओं में लार्ज लैंग्वेज मॉडल (LLM) के प्रदर्शन को महत्वपूर्ण रूप से सुधारने के लिए सामान्य सिस्टम प्रॉम्प्ट्स को अनुकूलित करता है, यह प्रदर्शित करते हुए कि एक एकल अनुकूलित सिस्टम प्रॉम्प्ट कार्य-विशिष्ट प्रॉम्प्ट्स के साथ मिलकर पूरक लाभ प्रदान करने के साथ-साथ उनकी प्रभावशीलता का मुकाबला कर सकता है।

Lechen Zhang, Tolga Ergen, Lajanugen Logeswaran, Moontae Lee, David Jurgens2026-04-07
💬 NLP

Document Parsing Unveiled: Techniques, Challenges, and Prospects for Structured Information Extraction

यह सर्वेक्षण एक वर्गीकरण प्रस्तावित करके दस्तावेज़ पार्सिंग अनुसंधान की एक व्यापक समीक्षा प्रदान करता है जो मॉड्यूलर पाइपलाइन सिस्टम और एकीकृत विजन-लैंग्वेज मॉडल दृष्टिकोणों के बीच अंतर करता है, साथ ही मजबूत दस्तावेज़ इंटेलिजेंस सिस्टम बनाने में प्रमुख घटकों, मूल्यांकन मानकों और भविष्य की चुनौतियों का विवरण देता है।

Qintong Zhang, Bin Wang, Victor Shea-Jay Huang, Junyuan Zhang, Zhengren Wang, Hao Liang, Conghui He, Wentao Zhang2026-04-07
💬 NLP

Leveraging ASIC AI Chips for Homomorphic Encryption

यह शोध पत्र CROSS को प्रस्तुत करता है, जो एक ऐसा कंपाइलर फ्रेमवर्क है जो उच्च-परिशुद्धता अंकगणित (high-precision arithmetic) और डेटा परम्यूटेशन को कुशल निम्न-परिशुद्धता मैट्रिक्स ऑपरेशन्स और ऑफलाइन पैरामीटर समायोजन में बदलकर TPUs जैसे AI एक्सेलेरेटर्स और होमोमॉर्फिक एन्क्रिप्शन वर्कलोड के बीच के आर्किटेक्चरल अंतर को पाटता है, जिससे AI ASICs पर HE के लिए अत्याधुनिक ऊर्जा दक्षता प्राप्त होती है।

Jianming Tong, Tianhao Huang, Jingtian Dang, Leo de Castro, Anirudh Itagi, Anupam Golder, Asra Ali, Jeremy Kun, Jevin Ji (…)2026-04-07
💬 NLP

Talk to Right Specialists: Iterative Routing in Multi-agent Systems for Question Answering

यह शोध पत्र RIRS का प्रस्ताव करता है, जो मल्टी-एजेंट प्रश्न उत्तर (question answering) के लिए एक ट्रेनिंग-फ्री ऑर्केस्ट्रेशन फ्रेमवर्क है, जो नॉलेज-सॉवरेन्टी बाधाओं को कुशलतापूर्वक संभालने और सभी एजेंटों को ब्रॉडकास्ट किए बिना सिंगल-हॉप और जटिल मल्टी-स्टेप क्वेरीज़ को हल करने के लिए एम्बेडिंग-आधारित क्वेरी रूटिंग और इटरेटिव रिस्पॉन्स एग्रीगेशन का उपयोग करता है।

Feijie Wu, Zitao Li, Fei Wei, Yaliang Li, Bolin Ding, Jing Gao2026-04-07
💬 NLP

Languages in Whisper-Style Speech Encoders Align Both Phonetically and Semantically

यह शोध पत्र प्रदर्शित करता है कि विस्पर-शैली (Whisper-style) के स्पीच एनकोडर्स वास्तविक क्रॉस-लिंगुअल सिमेंटिक अलाइनमेंट प्राप्त करते हैं, जो ध्वन्यात्मक ओवरलैप से भिन्न है, जिससे अर्ली-एक्जिटिंग रणनीतियों (early-exiting strategies) के माध्यम से कम-संसाधन वाली भाषाओं के लिए प्रभावी ज्ञान हस्तांतरण और प्रदर्शन लाभ संभव होता है।

Ryan Soh-Eun Shim, Domenico De Cristofaro, Chengzhi Martin Hu, Alessandro Vietti, Barbara Plank2026-04-07
💬 NLP

Complexity counts: global and local perspectives on Indo-Aryan numeral systems

यह शोधपत्र वैश्विक मानदंडों की तुलना में भारत-आर्य संख्या प्रणालियों की असामान्य रूप से उच्च जटिलता को परिमाणित करता है, उनकी निरंतरता को प्रेरित करने वाले सामाजिक-भौगोलिक कारकों की जांच करता है, और यह प्रदर्शित करता है कि अपने गैर-पारदर्शी रूपों के बावजूद, ये प्रणालियाँ अभी भी कुशल संचार के लिए क्रॉस-भाषाई दबावों का पालन करती हैं।

Chundra Cathcart2026-04-07
💬 NLP

Beyond Linear Steering: Unified Multi-Attribute Control for Language Models

यह शोधपत्र K-Steering को प्रस्तुत करता है, जो एक एकीकृत इन्फरेंस-टाइम विधि है जो लीनियर स्टीयरिंग की सीमाओं को दूर करने के लिए एक नॉन-लीनियर मल्टी-लेबल क्लासिफायर और ग्रेडिएंट-आधारित हस्तक्षेपों का लाभ उठाती है, जिससे बड़े भाषा मॉडलों में प्रति-एट्रिब्यूट ट्यूनिंग के बिना कई व्यवहार संबंधी गुणों पर गतिशील और सटीक नियंत्रण सक्षम होता है।

Narmeen Oozeer, Luke Marks, Shreyans Jain, Fazl Barez, Amirali Abdullah2026-04-07