🤖 AI

Choosing with unknown causal information: Action-outcome probabilities for decision making can be grounded in causal models

यह शोध पत्र यह प्रदर्शित करता है कि निर्णय लेने के लिए क्रिया-परिणाम की संभावनाओं को कैसे कारण संबंधी मॉडलों (causal models) में आधारित किया जा सकता है, जो अज्ञात कारण तंत्र वाले परिदृश्यों में तर्कसंगत विकल्प सिद्धांत (rational choice theory) का विस्तार करता है और कारण संबंधी जानकारी को शामिल करने के लिए नैश इक्विलिब्रियम (Nash Equilibrium) का सामान्यीकरण करता है।

Mauricio Gonzalez Soto, David Danks, Hugo J. Escalante Balderas, L. Enrique Sucar2026-04-30
🔬 materials science

NIMS-OS: An automation software to implement a closed loop between artificial intelligence and robotic experiments in materials science

NIMS-OS एक ओपन-सोर्स पायथन लाइब्रेरी और GUI एप्लिकेशन है जो इलेक्ट्रोलाइट्स जैसे नए पदार्थों की स्वायत्त खोज के लिए NAREE जैसे रोबोटिक प्रयोगात्मक प्रणालियों के साथ विविध AI एल्गोरिदम को एकीकृत करके पूर्णतः स्वचालित, क्लोज्ड-लूप सामग्री अनुसंधान को सक्षम बनाता है।

Ryo Tamura, Koji Tsuda, Shoichi Matsuda2026-04-30
🤖 AI

Speech-Gesture GAN: Gesture Generation for Robots and Embodied Agents

यह लेख एक स्पीच-जेस्चर-GAN फ्रेमवर्क का प्रस्ताव करता है जो एक सार्वजनिक डेटासेट से स्पीच टेक्स्ट, ऑडियो फीचर्स और जॉइंट एंगल्स के बीच के संबंधों को सीखकर, एम्बोडीड एजेंट्स के लिए यथार्थवादी को-स्पीच जेस्चर सीक्वेंस उत्पन्न करने के लिए एक कंडीशनल जेनरेटिव एडवरसैरियल नेटवर्क का उपयोग करता है।

Carson Yu Liu, Gelareh Mohammadi, Yang Song, Wafa Johal2026-04-30
💬 NLP

Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI

यह अध्ययन इस धारणा को चुनौती देता है कि मनुष्य एआई-जनित पाठ के बीच अंतर नहीं कर सकते, जो 16 बहुभाषी डेटासेट में 87.6% औसत पहचान सटीकता प्रदर्शित करके, वास्तविकता, सांस्कृतिक सूक्ष्मता और विविधता में प्रमुख अंतरों की पहचान करता है, और यह भी प्रकट करता है कि जब स्रोत संदिग्ध हो तो मनुष्य हमेशा मानव-लिखित पाठ को प्राथमिकता नहीं देते हैं।

Yuxia Wang, Rui Xing, Jonibek Mansurov, Giovanni Puccetti, Zhuohan Xie, Minh Ngoc Ta, Jiahui Geng, Jinyan Su, Mervat Aba (…)2026-04-30
💬 NLP

TinyR1-32B-Preview: Boosting Accuracy with Branch-Merge Distillation

यह शोध पत्र TinyR1-32B-Preview को प्रस्तुत करता है, जो एक नवीन 'ब्रांच-मर्ज डिस्टिलेशन' (Branch-Merge distillation) दृष्टिकोण के माध्यम से विकसित एक 32B-पैरामीटर वाला मॉडल है, जो विशिष्ट छात्र मॉडलों को चुनिंदा रूप से प्रशिक्षित करने और उन्हें मर्ज करने के माध्यम से गणित, कोडिंग और विज्ञान में मौजूदा डिस्टिल्ड समकक्षों से काफी बेहतर प्रदर्शन करता है और बड़े DeepSeek-R1 शिक्षक मॉडल के प्रदर्शन के बराबर पहुँच जाता है।

Lin Sun, Guangxiang Zhao, Xiaoqi Jian, Yuhan Wu, Weihong Lin, Yongfu Zhu, Qilong Shi, Change Jia, Aomufei Yuan, Yuxuan T (…)2026-04-30
🤖 AI

M2R2: MultiModal Robotic Representation for Temporal Action Segmentation

यह शोध पत्र M2R2 को प्रस्तुत करता है, जो एक नवीन मल्टीमॉडल फीचर एक्सट्रैक्टर है जो कई रोबोटिक डेटासेट्स में टेम्पोरल एक्शन सेगमेंटेशन के लिए अत्याधुनिक प्रदर्शन प्राप्त करने हेतु प्रोप्रियोसेप्टिव और एक्सटेरोसेप्टिव सेंसर डेटा को एक पुन: प्रयोज्य प्रशिक्षण रणनीति के साथ प्रभावी ढंग से संयोजित करता है।

Daniel Sliwowski, Dongheui Lee2026-04-30
🤖 AI

RetroMotion: Retrocausal Motion Forecasting Models are Instructable

रेट्रोमोशन (RetroMotion) एक ट्रांसफॉर्मर-आधारित मोशन फोरकास्टिंग मॉडल है जो एक रेट्रोकॉज़ल सूचना प्रवाह (retrocausal information flow) का उपयोग करके जटिल मल्टी-एजेंट भविष्यवाणियों को मार्जिनल और जॉइंट डिस्ट्रीब्यूशन में विभाजित करता है, जिससे प्रमुख डेटासेट्स पर अत्याधुनिक प्रदर्शन प्राप्त होता है और यह विशिष्ट रूप से सीन-एडेप्टिव इंस्ट्रक्शन फॉलोइंग का समर्थन करता है।

Royden Wagner, Omer Sahin Tas, Felix Hauser, Marlon Steiner, Dominik Strutz, Abhishek Vivekanandan, Jaime Villa, Yinzhe (…)2026-04-30
🤖 AI

Time Blindness: Why Video-Language Models Can't See What Humans Can?

यह शोधपत्र स्पूकीबेंच (SpookyBench) प्रस्तुत करता है, जो यह प्रदर्शित करता है कि अत्याधुनिक वीडियो-भाषा मॉडल उन पैटर्नों को पहचानने में विफल रहते हैं जो केवल शोर जैसे फ्रेमों के टेम्पोरल अनुक्रमों (temporal sequences) में एनकोड किए गए होते हैं जहाँ मनुष्य उत्कृष्ट प्रदर्शन करते हैं, जो स्थानिक विशेषताओं (spatial features) पर अत्यधिक निर्भरता और शुद्ध टेम्पोरल सूचना को संसाधित करने की मौलिक अक्षमता को प्रकट करता है।

Ujjwal Upadhyay, Mukul Ranjan, Zhiqiang Shen, Mohamed Elhoseiny2026-04-30
🤖 machine learning

PuckTrick: A Library for Making Synthetic Data More Realistic

यह शोध पत्र PuckTrick का परिचय देता है, जो एक पायथन लाइब्रेरी है जो व्यवस्थित रूप से मिसिंग वैल्यूज (missing values) और नॉइज़ (noise) जैसे नियंत्रित त्रुटियों को पेश करके सिंथेटिक डेटा की यथार्थता को बढ़ाती है, जिससे केवल स्वच्छ सिंथेटिक डेटासेट पर प्रशिक्षण लेने वाले मशीन लर्निंग मॉडल्स की तुलना में उनकी मजबूती और सामान्यीकरण क्षमता में वृद्धि होती है।

Alessandra Agostini, Andrea Maurino, Blerina Spahiu2026-04-30
🤖 AI

MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness

यह शोध पत्र MAGIC का प्रस्ताव करता है, जो एक फ्यू-शॉट विसंगति जनरेशन फ्रेमवर्क है जो मजबूत औद्योगिक गुणवत्ता नियंत्रण के लिए उच्च-निष्ठा (high-fidelity) और विविध विसंगतियों को उत्पन्न करने हेतु गॉसियन प्रॉम्प्ट परटर्बेशन, स्थानिक रूप से अनुकूलन योग्य मार्गदर्शन और संदर्भ-जागरूक मास्क संरेखण का लाभ उठाता है।

JaeHyuck Choi, MinJun Kim, Je Hyeong Hong2026-04-30