🧬 biology

Mechanistic Interpretability of Antibody Language Models Using SAEs

यह शोध पत्र ऑटोरेग्रेसिव एंटीबॉडी लैंग्वेज मॉडल्स की व्याख्या करने और उन्हें नियंत्रित करने के लिए TopK और ऑर्डर्ड स्पार्स ऑटोएनकोडर (SAEs) के उपयोग की जांच करता है, जिसमें यह पाया गया है कि जबकि जैविक अवधारणाओं को मैप करने के लिए TopK SAEs बेहतर हैं, सटीक जेनेरेटिव स्टीयरिंग के लिए ऑर्डर्ड SAEs अधिक प्रभावी हैं।

Rebonto Haque, Oliver M. Turnbull, Anisha Parsan, Nithin Parsan, John J. Yang, Anna L. Beukenhorst, Charlotte M. Deane2026-04-27
🤖 machine learning

TS-Arena -- A Live Forecast Pre-Registration Platform

TS-Arena एक लाइव पूर्वानुमान मंच है जो एक सख्त प्री-रजिस्ट्रेशन प्रोटोकॉल को लागू करके टाइम सीरीज़ फाउंडेशन मॉडल्स में टेस्ट-सेट संदूषण (contamination) को संबोधित करता है, जहाँ भविष्य के डेटा पर सामान्यीकरण क्षमताओं के मजबूत, वास्तविक समय के मूल्यांकन को सक्षम करने के लिए ग्राउंड-ट्रुथ डेटा मौजूद होने से पहले भविष्यवाणियाँ सबमिट की जाती हैं।

Marcel Meyer, Sascha Kaltenpoth, Henrik Albers, Kevin Zalipski, Oliver Müller2026-04-27
🤖 AI

Flexible Multitask Learning with Factorized Diffusion Policy

यह शोध पत्र एक नवीन मॉड्यूलर डिफ्यूजन पॉलिसी फ्रेमवर्क प्रस्तुत करता है जो जटिल, मल्टीमॉडल रोबोट एक्शन डिस्ट्रीब्यूशन को विशिष्ट घटकों में विभाजित करता है, जिससे पॉलिसी फिटिंग में सुधार होता है, नए कार्यों के लिए लचीला अनुकूलन सक्षम होता है, और कैटास्ट्रोफिक फॉरगेटिंग को कम किया जाता है, साथ ही यह सिमुलेशन और वास्तविक दुनिया दोनों परिवेशों में मौजूदा मोनोलिथिक और मॉड्यूलर बेसलाइन्स से बेहतर प्रदर्शन करता है।

Chaoqi Liu, Haonan Chen, Sigmund H. Høeg, Shaoxiong Yao, Yunzhu Li, Kris Hauser, Yilun Du2026-04-27
🤖 AI

AgentMark: Utility-Preserving Behavioral Watermarking for Agents

एजेंटमार्क (AgentMark) एक व्यवहारिक वॉटरमार्किंग फ्रेमवर्क है जिसे वितरण-संरक्षण सशर्त नमूनाकरण (distribution-preserving conditional sampling) के माध्यम से उनके उच्च-स्तरीय नियोजन निर्णयों में मल्टी-बिट पहचानकर्ताओं को एम्बेड करके एलएलएम-आधारित एजेंटों की बौद्धिक संपदा की रक्षा करने के लिए डिज़ाइन किया गया है, जो एजेंट के आंतरिक भार (internal weights) तक सीधी पहुँच की आवश्यकता के बिना या कार्य उपयोगिता से समझौता किए बिना मजबूत उत्पत्ति सुनिश्चित करता है।

Kaibo Huang, Jin Tan, Yukun Wei, Wanling Li, Zipei Zhang, Hui Tian, Zhongliang Yang, Linna Zhou2026-04-27
🤖 machine learning

Cross-Session Decoding of Neural Spiking Data via Task-Conditioned Latent Alignment

यह शोध पत्र टास्क-कंडीशन्ड लेटेंट अलाइनमेंट (TCLA) का प्रस्ताव करता है, जो एक ऑटोएनकोडर का लाभ उठाकर डेटा-समृद्ध स्रोत सत्रों से न्यूरल रिप्रजेंटेशन को डेटा-सीमित लक्ष्य सत्रों के साथ संरेखित करता है, जिससे मैकाक मोटर और ऑक्यूलोमोटर कार्यों में क्रॉस-सेशन न्यूरल डिकोडिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Canyang Zhao, Bolin Peng, J. Patrick Mayo, Ce Ju, Bing Liu2026-04-27
💬 NLP

AdaptEvolve: Improving Efficiency of Evolutionary AI Agents through Adaptive Model Selection

यह शोध पत्र AdaptEvolve प्रस्तुत करता है, जो एक ऐसा ढांचा है जो आंतरिक पीढ़ी विश्वास (intrinsic generation confidence) के आधार पर प्रत्येक परिशोधन चरण के लिए सबसे उपयुक्त लार्ज लैंग्वेज मॉडल को गतिशील रूप से चुनकर विकासवादी एआई एजेंटों की दक्षता में सुधार करता है, जिससे उच्च सटीकता बनाए रखते हुए अनुमान लागत (inference costs) में लगभग 38% की कमी आती है।

Pretam Ray, Pratik Prabhanjan Brahma, Zicheng Liu, Emad Barsoum2026-04-27
🤖 AI

Math Takes Two: A test for emergent mathematical reasoning in communication

यह शोध पत्र "मैथ टेक्स टू" (Math Takes Two) का परिचय देता है, जो एक नया बेंचमार्क है जिसे यह मूल्यांकन करने के लिए डिज़ाइन किया गया है कि क्या भाषा मॉडल वास्तविक उभरती हुई गणितीय तर्क क्षमता प्रदर्शित कर सकते हैं, जिसमें दो एजेंटों को प्रथम सिद्धांतों से दृश्य रूप से आधारित समस्याओं को हल करने के लिए एक साझा प्रतीकात्मक प्रोटोकॉल को सह-विकसित करने का कार्य दिया जाता है।

Michael Cooper, Samuel Cooper2026-04-27
💻 computer science

Feedback Over Form: Why Execution Feedback Matters More Than Pipeline Topology in 1-3B Code Generation

यह शोध पत्र प्रदर्शित करता है कि 1-3B पैरामीटर वाले कोड जनरेशन के लिए, एक सरल सेल्फ-रिफाइनमेंट लूप के माध्यम से निष्पादन फीडबैक (execution feedback) को शामिल करना, पाइपलाइन की जटिलता या आर्किटेक्चरल टोपोलॉजी बढ़ाने की तुलना में काफी अधिक प्रदर्शन लाभ प्रदान करता है।

Charles Junichi McAndrews2026-04-27
💻 computer science

A systematic review of generative AI usage for IT project management

PRISMA पद्धति का उपयोग करते हुए, यह व्यवस्थित समीक्षा आईटी परियोजना प्रबंधन में जनरेटिव एआई की वर्तमान स्थिति का अन्वेषण करती है, जिसमें यह पाया गया है कि अनुसंधान वर्तमान में एक खोजपूर्ण चरण में है जो GPT-आधारित प्रॉम्प्ट इंजीनियरिंग द्वारा प्रधान है और भविष्य की दिशाओं के रूप में विशेष एआई एजेंटों और मानव-एआई सहयोगात्मक नेटवर्क जैसे सुझाव देती है।

Ionut Anghel, Tudor Cioara2026-04-27
💻 computer science

A general optimization solver based on OP-to-MaxSAT reduction

यह शोध पत्र GORED का प्रस्ताव करता है, जो एक सामान्य अनुकूलन सॉल्वर (optimization solver) है जो विविध अनुकूलन समस्याओं को स्वचालित रूप से MaxSAT उदाहरणों में कम करके समस्या-समाधान बहुमुखीता को बढ़ाता है, जिससे एक एकल एकीकृत ढांचा विशिष्ट एल्गोरिदम के तुलनीय समाधान गुणवत्ता प्राप्त करने में सक्षम होता है।

Yuxin Zhao, Han Huang, Zhifeng Hao2026-04-27