💻 computer science

OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind

यह शोध पत्र OSCToM को प्रस्तुत करता है, जो एक सुदृढीकरण लर्निंग-निर्देशित (reinforcement learning-guided) दृष्टिकोण है जो ऑब्जर्वर-सेल्फ कॉन्फ्लिक्ट (observer-self conflict) परिदृश्य उत्पन्न करता है ताकि लार्ज लैंग्वेज मॉडल्स की थ्योरी ऑफ माइंड (Theory of Mind) तर्क क्षमता को महत्वपूर्ण रूप से बढ़ाया जा सके, जिससे पिछले तरीकों के 0.2% की तुलना में सूचना-असममित FANToM बेंचमार्क पर 76% सटीकता प्राप्त हुई।

Sharmin Sultana Srishty, Kazi Mahathir Rahman, Malaika Parizat Sakkhi, Samia Shahid Prianna, Shaikhul Islam Sinat2026-05-21
💻 computer science

AgentCo-op: Retrieval-Based Synthesis of Interoperable Multi-Agent Workflows

AgentCo-op एक रिट्रीवल-आधारित फ्रेमवर्क है जो टाइप किए गए आर्टिफ़ैक्ट हैंडऑफ और लोकल सेल्फ-रिपेयर के माध्यम से पुन: प्रयोज्य टूल्स और एजेंट्स को संयोजित करके इंटरऑपरेबल मल्टी-एजेंट वर्कफ़्लो को सिंथेसाइज़ करता है, जिससे ओपन-एंडेड वैज्ञानिक डोमेन में प्रभावी सहयोगात्मक खोज सक्षम होती है और कम लागत के साथ विभिन्न बेंचमार्क पर बेसलाइन्स से बेहतर प्रदर्शन होता है।

Shuaike Shen, Wenduo Cheng, Shike Wang, Mingqian Ma, Jian Ma2026-05-21
🤖 machine learning

Group-Algebraic Tensors: Provably-optimal Equivariant Learning and Physical Symmetry Discovery

यह शोध पत्र G\star_G टेंसर बीजगणित (tensor algebra) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो समरूपता (equivariance) को एक वास्तुशिल्प बाधा (architectural constraint) से एक अंतर्निहित बीजगणितीय गुण में परिवर्तित करता है, जिससे प्रमाणित रूप से इष्टतम समरूपता-संरक्षण टेंसर सन्निकटन (symmetry-preserving tensor approximation), प्रति-अपरिवर्तनीय प्रतिनिधित्व (per-irreducible-representation) पूर्वानुमानों के लिए बंद-रूप (closed-form) समाधान, और पूर्व क्वांटम यांत्रिक ज्ञान की आवश्यकता के बिना भौतिक समरूपताओं की डेटा-संचालित खोज सक्षम होती है।

Paulina Hoyos, Shashanka Ubaru, Dongsung Huh, Vasileios Kalantzis, Kenneth L. Clarkson, Misha Kilmer, Haim Avron, Lior H (…)2026-05-21
🤖 machine learning

Weight Decay Regimes in Grokking Transformers: Cheap Online Diagnostics

यह शोध पत्र प्रदर्शित करता है कि वेट डिके (weight decay) एक महत्वपूर्ण नियंत्रण पैरामीटर के रूप में कार्य करता है जो मॉड्यूलर अंकगणित पर प्रशिक्षित ट्रांसफॉर्मर्स में मेमोराइजेशन (memorization), जनरलाइजेशन (grokization/grokking), और कोलैप्स (collapse) के बीच संक्रमण को नियंत्रित करता है, और विभिन्न मॉडल स्केल्स और आर्किटेक्चर में इन डायनेमिक्स को ट्रैक करने के लिए अटेंशन एक्टिवेशन्स (attention activations) पर आधारित दो गणनात्मक रूप से कुशल ऑनलाइन डायग्नोस्टिक्स पेश करता है।

Lucky Verma2026-05-21
💻 computer science

Modeling Emotional Dynamics in Agent-to-Agent Interactions on Moltbook

यह शोध पत्र एक इमोशन-अवेयर फ्रेमवर्क और एक पर्सोना-स्टिमुलस-रिएक्शन (PSR) डोमेन को पेश करते हुए, टेक्स्टुअल इंटरैक्शन को सूक्ष्म भावनात्मक श्रेणियों में मैप करने और प्रतिक्रिया संरेखण का मूल्यांकन करने के माध्यम से, सोशल नेटवर्क मोल्टबुक (Moltbook) पर परस्पर क्रिया करने वाले बड़े पैमाने के एआई एजेंटों के भावनात्मक गतिशीलता और व्यवहारिक स्थिरता का विश्लेषण करता है।

Syed Mhamudul Hasan, Abdur R. Shahid2026-05-21
🤖 machine learning

LLM Pretraining Shapes a Generalizable Manifold: Insights into Cross-Modal Transfer to Time Series

यह शोध पत्र यह प्रदर्शित करता है कि भाषा-पूर्व-प्रशिक्षित (language-pretrained) ट्रांसफॉर्मर समय श्रृंखला (time series) का प्रभावी ढंग से पूर्वानुमान लगा सकते हैं क्योंकि पूर्व-प्रशिक्षण संरचनात्मक गतिकी के एक पुन: प्रयोज्य ज्यामितीय मैनिफोल्ड (geometric manifold) को स्थापित करता है, जिससे फाइन-ट्यूनिंग को केवल संख्यात्मक डेटा को इन मौजूदा दिशाओं पर संरेखित करने की अनुमति मिलती है बजाय इसके कि वे शून्य से टेम्पोरल प्रिमिटिव्स (temporal primitives) को सीखें।

Alexis Roger, Prateek Humane, Zhenghan Tai, Gwen Legate, Andrei Mircea, Vasilii Feofanov, Irina Rish2026-05-21
💻 computer science

Agentic Agile-V: From Vibe Coding to Verified Engineering in Software and Hardware Development

यह शोध पत्र तर्क देता है कि जबकि एजेंटिक एआई उत्पादकता लाभ की क्षमता प्रदान करता है, सॉफ्टवेयर और हार्डवेयर विकास में इसके पूर्ण मूल्य को साकार करने के लिए प्रॉम्प्ट इंजीनियरिंग से हटकर एक अनुशासित प्रक्रिया नियंत्रण ढांचे की ओर जाने की आवश्यकता है जिसे "एजेंटिक एजाइल-वी" (Agentic Agile-V) कहा जाता है, जो संवादात्मक इरादे को सत्यापित, साक्ष्य-आधारित इंजीनियरिंग आर्टिफैक्ट्स में बदलने के लिए एक एजाइल-वी लाइफसाइकिल को टास्क-लेवल SCOPE-V लूप के साथ एकीकृत करता है।

Christopher Koch2026-05-21
💻 computer science

High Quality Embeddings for Horn Logic Reasoning

यह शोध पत्र हॉर्न लॉजिक (Horn Logic) तर्क के लिए नवीन एम्बेडिंग रणनीतियों का प्रस्ताव और मूल्यांकन करता है जो तार्किक खोज और रैंकिंग की दक्षता में सुधार करने के लिए एंकर जनरेशन (anchor generation) और डिफिकल्टी-बैलेंस्ड सैंपलिंग (difficulty-balanced sampling) की विशिष्ट तकनीकों के साथ ट्रिपलेट लॉस (triplet loss) का उपयोग करते हैं।

Yifan Zhang, Yasir White, Dean Clark, Joseph Sanchez, Jevon Lipsey, Ashely Hirst, Jeff Heflin2026-05-21
🔬 physics

EPC-3D-Diff: Equivariant Physics Consistent Conditional 3D Latent Diffusion for CBCT to CT Synthesis

यह शोध पत्र EPC-3D-Diff का प्रस्ताव करता है, जो एक नवीन कंडीशनल 3D लेटेंट डिफ्यूजन फ्रेमवर्क है जो CBCT स्कैन से उच्च-गुणवत्ता वाले, HU-सटीक CT वॉल्यूम को संश्लेषित करने के लिए भौतिकी-व्युत्पन्न प्रोजेक्शन डोमेन इक्विवैरिएंस लॉस को एकीकृत करता है, जो फैंटम और क्लिनिकल दोनों डेटासेट में अत्याधुनिक विधियों से काफी बेहतर प्रदर्शन करता है।

Alzahra Altalib, Chunhui Li, Haytham Al Ewaidat, Khaled Alawneh, Ahmad Qendel, Alessandro Perelli2026-05-21
🤖 machine learning

Training Language Agents to Learn from Experience

यह शोध पत्र इन-कॉन्टेक्स्ट ट्रेनिंग (ICT) फ्रेमवर्क और एक सुदृढीकरण लर्निंग-आधारित पाइपलाइन पेश करता है जो भाषा एजेंटों को पिछले इंटरैक्शन से अनुभव को पुन: प्रयोज्य सिस्टम प्रॉम्प्ट्स में संकुचित करने में सक्षम बनाता है, जिससे वे मानवीय पर्यवेक्षण के बिना क्रॉस-टास्क आत्म-सुधार और अनदेखे वातावरणों में सामान्यीकरण प्राप्त करते हैं।

Yuval Shalev, Zifeng Ding, Mateja Jamnik2026-05-21