💻 computer science

Aligning with Your Own Voice: Self-Corrected Preference Learning for Hallucination Mitigation in LVLMs

यह शोध पत्र AVES-DPO का प्रस्ताव करता है, जो एक स्व-सुधारित प्राथमिकता शिक्षण ढांचा (self-corrected preference learning framework) है जो एक सर्वसम्मति-आधारित सत्यापन तंत्र के माध्यम से इन-डिस्ट्रीब्यूशन प्राथमिकता युग्मों को उत्पन्न करके लार्ज विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को कम करता है, जिससे प्रोप्रायटरी मॉडल्स पर निर्भरता के कारण होने वाले वितरण संबंधी बेमेल (distributional mismatch) को दूर किया जा सके।

Byeonggeuk Lim, JungMin Yun, Junehyoung Kwon, Kyeonghyun Kim, YoungBin Kim2026-04-28
⚡ electrical engineering

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation

यह शोध पत्र एक नैदानिक ढांचे (diagnostic framework) को प्रस्तुत करता है जो यह प्रकट करता है कि कई लार्ज ऑडियो-लैंग्वेज मॉडल्स वास्तविक श्रवण बोध के बजाय टेक्स्ट प्रायर्स (text priors) और स्थानीयकृत ऑडियो अंशों पर निर्भर करके उच्च बेंचमार्क स्कोर प्राप्त करते हैं, जो यह सुझाव देता है कि वर्तमान मूल्यांकन अक्सर वास्तविक ऑडियो समझ को मापने में विफल रहते हैं।

Leonardo Haw-Yang Foo, Chih-Kai Yang, Chen-An Li, Ke-Han Lu, Hung-yi Lee2026-04-28
⚡ electrical engineering

BandRouteNet: An Adaptive Band Routing Neural Network for EEG Artifact Removal

BandRouteNet एक अनुकूलन योग्य, पैरामीटर-कुशल न्यूरल नेटवर्क है जो EEG डिनोइजिंग (denoising) के लिए उपयोग किया जाता है, जो विविध आर्टिफैक्ट्स जैसे EOG और EMG को प्रभावी ढंग से हटाने के लिए एक फ्रीक्वेंसी-अवेयर रूटिंग मैकेनिज्म और एक फुल-बैंड कंडीशनर का उपयोग करता है।

Phat Lam2026-04-28
💻 computer science

Characterizing Vision-Language-Action Models across XPUs: Constraints and Acceleration for On-Robot Deployment

यह शोध पत्र विभिन्न एक्सीलरेटरों के माध्यम से मॉडल-हार्डवेयर ट्रेड-ऑफ का व्यवस्थित रूप से मूल्यांकन करके, एक दो-चरणीय अनुमान बाधा (two-phase inference bottleneck) की पहचान करके, और न्यूनतम प्रदर्शन हानि के साथ दोनों GPU और एज NPU पर महत्वपूर्ण गति प्राप्त करने के लिए DP-Cache और V-AEFusion तकनीकों का प्रस्ताव देकर, संसाधन-सीमित रोबोटों पर विजन-लैंग्वेज-एक्शन (VLA) मॉडल तैनात करने की चुनौतियों का समाधान करता है।

Kaijun Zhou, Qiwei Chen, Da Peng, Zhiyang Li, Xijun Li, Jinyu Gu2026-04-28
💻 computer science

Measuring Successful Cooperation in Human-AI Teamwork: Development and Validation of the Perceived Cooperativity and Teaming Perception Scales

यह शोध पत्र दो नए पैमानों, परसीव्ड कूपरेटिविटी स्केल (PCS) और टीमिंग परसेप्शन स्केल (TPS) को प्रस्तुत और मान्य करता है, जो तीन अनुभवजन्य अध्ययनों के माध्यम से विविध संदर्भों में मानव-एआई टीम वर्क की व्यक्तिपरक गुणवत्ता को प्रभावी ढंग से मापते हैं।

Christiane Attig, Christiane Wiebel-Herboth, Patricia Wollstadt, Tim Schrills, Mourad Zoubir, Thomas Franke2026-04-28
💻 computer science

Agentic clinical reasoning over longitudinal myeloma records: a retrospective evaluation against expert consensus

यह पूर्वव्यापी अध्ययन प्रदर्शित करता है कि एक एजेंटिक क्लिनिकल रीजनिंग सिस्टम, विशेषज्ञ सर्वसम्मति से मेल खाने के लिए मल्टीपल मायलोमा के अनुदैर्ध्य (लॉन्गीटुडिनल) रिकॉर्ड्स को संश्लेषित करने में मानक RAG और फुल-कॉन्टेक्स्ट दृष्टिकोणों से बेहतर प्रदर्शन करता है, विशेष रूप से जटिल मामलों में, हालांकि इसके अवशिष्ट त्रुटियों की उच्च गंभीरता नैदानिक तैनाती से पहले भावी सत्यापन (प्रोस्पेक्टिव वैलिडेशन) को आवश्यक बनाती है।

Johannes Moll, Jannik Lübberstedt, Christoph Nuernbergk, Jacob Stroh, Luisa Mertens, Anna Purcarea, Christopher Zirn, Ze (…)2026-04-28
🤖 machine learning

Deployment-Aligned Low-Precision Neural Architecture Search for Spaceborne Edge AI

यह शोध पत्र एक हार्डवेयर-जागरूक न्यूरल आर्किटेक्चर सर्च (NAS) फ्रेमवर्क प्रस्तावित करता है जो फुल-प्रिसिजन ट्रेनिंग और स्पेसबोर्न VPUs जैसे संसाधन-सीमित एज हार्डवेयर पर परिनियोजन के बीच सटीकता के अंतर को पाटने के लिए अनुकूलन प्रक्रिया में सीधे लो-प्रिसिजन संख्यात्मक बाधाओं को एकीकृत करता है।

Parampuneet Kaur Thind, Vaibhav Katturu, Giacomo Zema, Roberto Del Prete2026-04-28
🤖 machine learning

MIMIC: A Generative Multimodal Foundation Model for Biomolecules

MIMIC एक जनरेटिव मल्टीमॉडल फाउंडेशन मॉडल है जिसे संरेखित (aligned) LORE डेटासेट पर प्रशिक्षित किया गया है, जो अनुक्रम (sequence), संरचना (structure) और नियामक (regulatory) मोडैलिटीज को एकीकृत करने के लिए एक स्प्लिट-ट्रैक आर्किटेक्चर का उपयोग करता है, जिससे जीनोम, ट्रांसक्रिप्टोम और प्रोटिओम में बायोमॉलिक्यूलर रिप्रेजेंटेशन लर्निंग, कंडीशनल प्रेडिक्शन और कंस्ट्रेंड डिज़ाइन में अत्याधुनिक प्रदर्शन सक्षम होता है।

Siavash Golkar, Jake Kovalic, Irina Espejo Morales, Samuel Sledzieski, Minhuan Li, Ksenia Sokolova, Geraud Krawezik, Alb (…)2026-04-28
💻 computer science

Beyond the Attention Stability Boundary: Agentic Self-Synthesizing Reasoning Protocols

यह शोध पत्र सेल्फ-सिंथेसाइजिंग रीजनिंग प्रोटोकॉल (SSRP) को प्रस्तुत करता है, जो एक मेटाकॉग्निटिव फ्रेमवर्क है जो स्वायत्त LLM एजेंटों में "अटेंशन लैच" विफलता मोड से उबरने के लिए आर्किटेक्चरल प्लानिंग को प्रोसीजरल एक्जीक्यूशन से अलग करता है, और कई आर्किटेक्चर और डेटासेट्स में बेसलाइन मॉडल्स की तुलना में 715 गुना लचीलापन सुधार प्रदर्शित करता है।

Dahlia Shehata, Ming Li2026-04-28
💻 computer science

Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models

यह शोध पत्र लेयरवाइज़ कन्वर्जेंस फिंगरप्रिंटिंग (LCF) को प्रस्तुत करता है, जो एक ट्यूनिंग-मुक्त रनटाइम मॉनिटर है जो बिना किसी संदर्भ मॉडल, ट्रिगर ज्ञान या पुन: प्रशिक्षण की आवश्यकता के, इंटर-लेयर हिडन-स्टेट प्रक्षेप पथों (trajectories) का विश्लेषण करके कई आर्किटेक्चरों में विविध LLM दुर्व्यवहारों—जिसमें बैकडोर्स, जेलब्रेक्स और प्रॉम्प्ट इंजेक्शन शामिल हैं—का पता लगाता है।

Nay Myat Min, Long H. Pham, Jun Sun2026-04-28