🤖 AI

Enhancing Retrieval-Augmented Generation with Entity Linking for Educational Platforms

यह शोध पत्र ELERAG को प्रस्तुत करता है, जो एक उन्नत रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) प्रणाली है जो इतालवी शैक्षिक प्रश्न-उत्तर में तथ्यात्मक सटीकता में उल्लेखनीय सुधार करने के लिए विकीडेटा-आधारित एंटिटी लिंकिंग और एक हाइब्रिड री-रैंकिंग रणनीति को एकीकृत करता है, जो विशेष रूप से डोमेन-विशिष्ट संदर्भों में मानक तरीकों से बेहतर प्रदर्शन करते हुए डोमेन-अनुकूलित रणनीतियों के महत्व को प्रदर्शित करता है।

Francesco Granata, Francesco Poggi, Misael Mongiovì2026-03-11
💬 NLP

EVM-QuestBench: An Execution-Grounded Benchmark for Natural-Language Transaction Code Generation

यह शोध पत्र EVM-QuestBench प्रस्तुत करता है, जो 107 परमाणु (atomic) और मिश्रित (composite) कार्यों के डायनेमिक, फोर्क-आधारित परीक्षण के माध्यम से EVM-संगत चेन्स पर प्राकृतिक भाषा लेनदेन कोड जनरेशन की सुरक्षा और सटीकता का कड़ाई से मूल्यांकन करने के लिए डिज़ाइन किया गया एक निष्पादन-आधारित (execution-grounded) बेंचमार्क है।

Pei Yang, Wanyi Chen, Ke Wang, Lynn Ai, Eric Yang, Tianyu Shi2026-03-11
⚡ electrical engineering

Rethinking Discrete Speech Representation Tokens for Accent Generation

यह शोध पत्र इस बात की पहली व्यवस्थित जांच प्रस्तुत करता है कि डिस्क्रीट स्पीच रिप्रेजेंटेशन टोकेन्स (DSRTs) में लहजे (accent) की जानकारी कैसे एनकोड की जाती है, जो एक एकीकृत मूल्यांकन ढांचे को पेश करता है जो यह प्रकट करता है कि लेयर चयन लहजे को बनाए रखने के लिए सबसे महत्वपूर्ण कारक है, जबकि ASR पर्यवेक्षण उन्हें काफी कम कर देता है और सहज कोडबुक न्यूनीकरण ध्वन्यात्मक और वक्ता की जानकारी से लहजे को अलग करने में विफल रहता है।

Jinzuomu Zhong, Yi Wang, Korin Richmond, Peter Bell2026-03-11
💬 NLP

Query-focused and Memory-aware Reranker for Long Context Processing

यह शोध पत्र एक हल्का, मेमोरी-अवेयर रीरैंकिंग फ्रेमवर्क प्रस्तावित करता है जो लिकर्ट-स्केल पर्यवेक्षण (Likert-scale supervision) की आवश्यकता के बिना निरंतर, लिस्टवाइज प्रासंगिकता स्कोर प्रदान करके लॉन्ग-कॉन्टेक्स्ट प्रोसेसिंग और संवाद समझ में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए छोटे पैमाने के मॉडलों में चयनित हेड्स से अटेंशन स्कोर का लाभ उठाता है।

Yuqing Li, Jiangnan Li, Mo Yu, Guoxuan Ding, Zheng Lin, Weiping Wang, Jie Zhou2026-03-11
🤖 machine learning

Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis

यह शोध पत्र 'मिसिंग-बाय-डिजाइन' (MBD) को प्रस्तुत करता है, जो प्रतिसंहरणीय (revocable) मल्टीमॉडल सेंटीमेंट एनालिसिस के लिए एक एकीकृत ढांचा है, जो विशिष्ट डेटा मोडैलिटीज के मशीन-सत्यापनीय विलोपन को सक्षम करने के लिए संरचित प्रतिनिधित्व शिक्षण (structured representation learning) को एक प्रमाणित पैरामीटर-संशोधन पाइपलाइन के साथ जोड़ता है, जिससे भविष्य कहनेवाला प्रदर्शन और गोपनीयता अनुपालन बना रहता है।

Rong Fu, Ziming Wang, Chunlei Meng, Jiaxuan Lu, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong2026-03-11
💬 NLP

AuditBench: Evaluating Alignment Auditing Techniques on Models with Hidden Behaviors

यह शोधपत्र AuditBench प्रस्तुत करता है, जो निहित छिपे हुए व्यवहारों (implanted hidden behaviors) वाले 56 भाषा मॉडलों का एक बेंचमार्क है, ताकि एलाइनमेंट ऑडिटिंग तकनीकों का मूल्यांकन किया जा सके और यह प्रकट किया जा सके कि हालांकि स्कैफोल्डेड ब्लैक-बॉक्स प्रॉम्प्टिंग उपकरण सबसे प्रभावी हैं, लेकिन स्वायत्त एजेंटों (autonomous agents) में एकीकृत होने पर उनका प्रदर्शन अक्सर घट जाता है, और ऑडिटिंग की कठिनाई मॉडलों की प्रशिक्षण विधियों के आधार पर काफी भिन्न होती है।

Abhay Sheshadri, Aidan Ewart, Kai Fronsdal, Isha Gupta, Samuel R. Bowman, Sara Price, Samuel Marks, Rowan Wang2026-03-11
💬 NLP

A Browser-based Open Source Assistant for Multimodal Content Verification

यह शोध पत्र VERIFICATION ASSISTANT को प्रस्तुत करता है, जो एक व्यापक रूप से उपयोग किए जाने वाले प्लगइन में एकीकृत एक ब्राउज़र-आधारित ओपन-सोर्स टूल है, जो विश्वसनीयता संकेतों और एआई-जनरेटेड कंटेंट (AI-generated content) के लिए यूआरएल (URL) और मीडिया फाइलों का स्वचालित रूप से विश्लेषण करने हेतु कई एनएलपी (NLP) क्लासिफायर को एकीकृत करके पत्रकारों और तथ्य-जांचकर्ताओं को सशक्त बनाता है।

Rosanna Milner, Michael Foster, Olesya Razuvayevskaya, Ian Roberts, Valentin Porcellini, Denis Teyssou, Kalina Bontcheva2026-03-11
💻 computer science

VeriInteresting: An Empirical Study of Model Prompt Interactions in Verilog Code Generation

यह शोध पत्र एक अनुभवजन्य अध्ययन प्रस्तुत करता है जो Verilog कोड जनरेशन के लिए मॉडल विशेषताओं और प्रॉम्प्ट इंजीनियरिंग रणनीतियों के बीच की अंतःक्रियाओं को मैप करता है, जो नियंत्रित प्रयोगों के माध्यम से यह प्रकट करता है कि कौन से रुझान विविध भाषा मॉडलों और बेंचमार्क में सामान्य होते हैं।

Luca Collini, Andrew Hennesee, Patrick Yubeaton, Siddharth Garg, Ramesh Karri2026-03-11
💻 computer science

Self-hosted Lecture-to-Quiz: Local LLM MCQ Generation with Deterministic Quality Control

यह शोध पत्र एक एंड-टू-एंड, सेल्फ-होस्टेड पाइपलाइन प्रस्तुत करता है जो एक स्थानीय LLM और नियत गुणवत्ता नियंत्रण का उपयोग करके लेक्चर PDF को बहुविकल्पीय प्रश्नों में परिवर्तित करता है, जो शैक्षिक उपयोग के लिए एक विस्तृत चेतावनी वर्गीकरण के साथ एक सत्यापित 24-प्रश्नों के डेटासेट को जारी करते हुए गोपनीयता और जवाबदेही सुनिश्चित करता है।

Seine A. Shintani2026-03-11
🤖 AI

Fish Audio S2 Technical Report

यह शोध पत्र Fish Audio S2 को प्रस्तुत करता है, जो एक ओपन-सोर्स टेक्स्ट-टू-स्पीच सिस्टम है जो नेचुरल-लैंग्वेज इंस्ट्रक्शन फॉलोइंग के साथ मल्टी-स्पीकर, मल्टी-टर्न जनरेशन को सक्षम करने के लिए एक मल्टी-स्टेज ट्रेनिंग पाइपलाइन का लाभ उठाता है, जबकि प्रोडक्शन-रेडी वेट्स और एक कुशल SGLang-आधारित इन्फरेंस इंजन प्रदान करता है।

Shijia Liao, Yuxuan Wang, Songting Liu, Yifan Cheng, Ruoyi Zhang, Tianyu Li, Shidong Li, Yisheng Zheng, Xingwei Liu, Qin (…)2026-03-11