🤖 machine learning

MermaidSeqBench: An Evaluation Benchmark for NL-to-Mermaid Sequence Diagram Generation

यह शोधपत्र MermaidSeqभेंच (MermaidSeqBench) को प्रस्तुत करता है, जो 132 मानव-सत्यापित और सिंथेटिक रूप से विस्तारित नमूनों से बना एक नया बेंचमार्क है, जिसे सूक्ष्म (fine-grained), LLM-एज़-अ-जज मेट्रिक्स का उपयोग करके प्राकृतिक भाषा विवरणों से सटीक रूप से मर्मेड (Mermaid) अनुक्रम आरेख उत्पन्न करने की बड़े भाषा मॉडलों (LLMs) की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Basel Shbita, Farhan Ahmed, Chad DeLuca2026-04-28
🤖 machine learning

Predicting one-year clinical instability and mortality in heart failure patients using sequence modeling

यह शोध पत्र प्रदर्शित करता है कि ऑटोरिग्रेसिव सीक्वेंस मॉडल, जैसे कि Llama और Mamba, नियमित इलेक्ट्रॉनिक हेल्थ रिकॉर्ड डेटा का उपयोग करके हार्ट फेल्योर के रोगियों में एक-वर्षीय क्लिनिकल अस्थिरता और मृत्यु दर की सटीक भविष्यवाणी कर सकते हैं, जो जोखिम स्तरीकरण और व्यक्तिगत डिस्चार्ज योजना के लिए एक ढांचा प्रदान करता है।

Falk Dippel, Yinan Yu, Annika Rosengren, Martin Lindgren, Christina E. Lundberg, Erik Aerts, Martin Adiels, Helen Sjölan (…)2026-04-28
📊 statistics

Bayesian Optimization for Function-Valued Responses under Min-Max Criteria

यह शोध पत्र मिन-मैक्स फंक्शनल बेयसियन ऑप्टिमाइज़ेशन (MM-FBO) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो फंक्शनल प्रिंसिपल कंपोनेंट एनालिसिस और गॉसियन प्रोसेस का उपयोग करके फंक्शनल रिस्पॉन्स वाले महंगे ब्लैक-बॉक्स फंक्शन्स को अनुकूलित करता है ताकि फंक्शनल डोमेन में अधिकतम त्रुटि को सीधे कम किया जा सके।

Pouya Ahadi, Reza Marzban, Ali Adibi, Kamran Paynabar2026-04-28
💻 computer science

Visual Funnel: Resolving Contextual Blindness in Multimodal Large Language Models

यह शोध पत्र विजुअल फनल (Visual Funnel) का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त दो-चरणीय विधि है जो सूक्ष्म विवरणों और वैश्विक संदर्भ के बीच संरचनात्मक विविधता को बनाए रखने के लिए पदानुक्रमित छवि क्रॉप्स (hierarchical image crops) के एक एंट्रॉपी-स्केल्ड पोर्टफोलियो को गतिशील रूप से निर्मित करके मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में "कॉन्टेक्स्टुअल ब्लाइंडनेस" (Contextual Blindness) को हल करता है।

Woojun Jung, Jaehoon Go, Mingyu Jeon, Sunjae Yoon, Junyeong Kim2026-04-28
🤖 machine learning

Selective Conformal Risk Control

यह शोध पत्र **सेलेक्टिव कॉन्फॉर्मल रिस्क कंट्रोल (SCRC)** का प्रस्ताव करता है, जो एक एकीकृत ढांचा है जो संक्षिप्त और विश्वसनीय प्रेडिक्शन सेट्स (prediction sets) उत्पन्न करने के लिए सेलेक्टिव क्लासिफिकेशन को कॉन्फॉर्मल प्रेडिक्शन के साथ जोड़ता है, जो पहले आत्मविश्वासी नमूनों का चयन करता है और फिर चयनित उपसमूह पर रिस्क कंट्रोल लागू करता है।

Yunpeng Xu, Wenge Guo, Zhi Wei2026-04-28
🧬 biology

Scalable Agentic Reasoning for Designing Biologics Targeting Intrinsically Disordered Proteins

यह शोध पत्र StructBioReasoner को प्रस्तुत करता है, जो एक स्केलेबल मल्टी-एजेंट सिस्टम है जो "अनड्रगेबल" (undruggable) इंट्रिन्सिकली डिसऑर्डर्ड प्रोटीन्स (IDPs) को लक्षित करने वाले उच्च-एफिनिटी बायोलॉजिक्स को स्वायत्त रूप से डिजाइन करने के लिए एक टूर्नामेंट-आधारित रीजनिंग फ्रेमवर्क और फेडरेटेड मिडलवेयर का उपयोग करता है।

Matthew Sinclair, Moeen Meigooni, Archit Vasan, Ozan Gokdemir, Xinran Lian, Heng Ma, Yadu Babuji, Alexander Brace, Khali (…)2026-04-28
⚡ electrical engineering

Energy-Aware Routing to Large Reasoning Models

यह शोध पत्र इस बात को स्पष्ट करते हुए कि सिस्टम का प्रदर्शन ऊर्जा अस्थिरता (energy volatility) द्वारा कैसे सीमित होता है, लार्ज रीजनिंग मॉडल्स (LRMs) के लिए ऊर्जा-जागरूक रूटिंग हेतु एक सैद्धांतिक ढांचा प्रस्तावित करता है और स्केलिंग लॉज़ (scaling laws) पर आधारित वेरिएंस-अवेयर डिस्पैच नीतियों के लिए एक आधार प्रदान करता है।

Austin R. Ellis-Mohr, Max Hartman, Lav R. Varshney2026-04-28
💻 computer science

SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models

SCRIBE एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो कौशल-सशर्त पुरस्कार मॉडलों (skill-conditioned reward models) के माध्यम से संरचित, मध्य-स्तरीय पर्यवेक्षण पेश करके टूल-उपयोग करने वाले भाषा मॉडलों को उन्नत करता है, जो रिवॉर्ड वेरिएन्स (reward variance) को कम करके और कौशल महारत से उच्च-स्तरीय योजना तक एक स्पष्ट प्रगति स्थापित करके तर्क की सटीकता और मल्टी-टर्न टूल इंटरेक्शन की सफलता में महत्वपूर्ण सुधार करता है।

Yuxuan Jiang, Francis Ferraro2026-04-28
💻 computer science

CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning

यह शोध पत्र CURE-MED को प्रस्तुत करता है, जो एक पाठ्यक्रम-सूचित सुदृढीकरण शिक्षण (curriculum-informed reinforcement learning) ढांचा है और नए बहुभाषी CUREMED-BENCH डेटासेट द्वारा समर्थित है, जो विश्वसनीय चिकित्सा तर्क के लिए तेरह विविध भाषाओं में बड़े भाषा मॉडलों की तार्किक शुद्धता और भाषाई स्थिरता को महत्वपूर्ण रूप से बढ़ाता है।

Eric Onyame, Akash Ghosh, Subhadip Baidya, Sriparna Saha, Xiuying Chen, Chirag Agarwal2026-04-28
💻 computer science

From Static to Interactive: Authoring Interactive Visualizations via Natural Language

यह शोधपत्र अथाনর (Athanor) को प्रस्तुत करता है, जो एक नवीन प्रणाली है जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स और प्राकृतिक भाषा निर्देशों का लाभ उठाकर मौजूदा स्थिर विज़ुअलाइज़ेशन को बिना प्रोग्रामिंग या मूल सोर्स कोड तक पहुँच के इंटरैक्टिव में बदल देती है।

Can Liu, Jaeuk Lee, Tianhe Chen, Zhibang Jiang, Xiaolin Wen, Yong Wang2026-04-28