🤖 machine learning

GAVEL: Towards Rule-Based Safety Through Activation Monitoring

यह योगदान GAVEL को प्रस्तुत करता है, जो एक नवीन ढांचा है जो एक्टिवेशन्स (activations) को व्याख्यात्मक संज्ञानात्मक तत्वों के रूप में मॉडल करके और हानिकारक व्यवहारों का सटीक, अनुकूलन योग्य और सत्यापन योग्य पता लगाने के लिए नियम-आधारित निगरानी लागू करके LLM सुरक्षा को बढ़ाता है, बिना मॉडल को पुन: प्रशिक्षित किए।

Shir Rozenfeld, Rahul Pankajakshan, Itay Zloczower, Eyal Lenga, Gilad Gressel, Yisroel Mirsky2026-05-01
🤖 AI

From Competition to Collaboration: Designing Sustainable Mechanisms Between LLMs and Online Forums

यह शोध पत्र बड़े भाषा मॉडलों (Large Language Models) और ऑनलाइन प्रश्नोत्तर मंचों के बीच सतत सहयोग के लिए एक डेटा-संचालित ढांचे का प्रस्ताव और मूल्यांकन करता है, जो यह प्रदर्शित करता है कि प्रोत्साहन संबंधी विसंगतियों के बावजूद, ऐसे सिस्टम क्रमिक संपर्क तंत्रों के माध्यम से एक आदर्श पूर्ण-सूचना परिदृश्य की लगभग आधी उपयोगिता प्राप्त कर सकते हैं।

Niv Fono, Yftah Ziser, Omer Ben-Porat2026-05-01
🤖 AI

Progressive Multi-Agent Reasoning for Biological Perturbation Prediction

यह शोध पत्र LINCSQA प्रस्तुत करता है, जो बल्क-सेल वातावरण में रासायनिक विक्षोभ (chemical perturbations) के तहत जीन विनियमन की भविष्यवाणी करने के लिए एक नया बेंचमार्क है, और PBio-Agent का प्रस्ताव करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो बिना किसी अतिरिक्त प्रशिक्षण के जटिल जैविक प्रक्रियाओं की भविष्यवाणी करने और उन्हें समझाने में मौजूदा बेसलाइनों से बेहतर प्रदर्शन करने के लिए कठिनाई-जागरूक कार्य अनुक्रमण (difficulty-aware task sequencing) और जैविक ज्ञान ग्राफ (biological knowledge graphs) का लाभ उठाता है।

Hyomin Kim, Sang-Yeon Hwang, Jaechang Lim, Yinhua Piao, Yunhak Oh, Woo Youn Kim, Chanyoung Park, Sungsoo Ahn, Junhyeok J (…)2026-05-01
🤖 machine learning

GRASP: group-Shapley feature selection for patients

यह कार्य GRASP प्रस्तुत करता है, जो एक नवीन फीचर चयन ढांचा (framework) है जो चिकित्सा भविष्यवाणियों के लिए स्थिर, व्याख्या योग्य और गैर-अनावश्यक फीचर सेट प्राप्त करने के लिए शपली वैल्यू असाइनमेंट (Shapley value assignment) को ग्रुप-L21L_{21} रेगुलराइजेशन के साथ जोड़ता है, जिससे यह सटीकता और फीचर स्थिरता दोनों में LASSO जैसे मौजूदा तरीकों से बेहतर प्रदर्शन करता है।

Yuheng Luo, Shuyan Li, Zhong Cao2026-05-01
🤖 AI

Agentic AI for Cybersecurity: A Meta-Cognitive Architecture for Governable Autonomy

यह शोध पत्र साइबर सुरक्षा के लिए एक संभाव्य, एजेंटिक ढांचे का प्रस्ताव करता है जो अनिश्चितता और प्रतिकूल परिस्थितियों के प्रबंधन में विशिष्ट एजेंटों को समन्वित करने के लिए एक मेटा-कॉग्निटिव आर्किटेक्चर का उपयोग करता है, जिससे पारंपरिक नियतात्मक प्रणालियों की तुलना में अधिक सुदृढ़, जवाबदेह और अनुकूलन योग्य निर्णय लेने में सक्षम बनाया जा सके।

Andrei Kojukhov, Arkady Bovshover2026-05-01
📊 statistics

Making Conformal Predictors Robust in Healthcare Settings: a Case Study on EEG Classification

यह शोध पत्र यह प्रदर्शित करके स्वास्थ्य सेवा में वितरण बदलाव (distribution shifts) की चुनौती को संबोधित करता है कि व्यक्तिगत अंशांकन रणनीतियाँ (personalized calibration strategies) EEG दौरे के वर्गीकरण के लिए कॉन्फॉर्मल प्रेडिक्टर्स के कवरेज में महत्वपूर्ण सुधार करती हैं, जिससे उच्च-जोखिम वाले नैदानिक परिवेशों में अनिश्चितता मात्रा निर्धारण की विश्वसनीयता बढ़ती है।

Arjun Chatterjee, Sayeed Sajjad Razin, John Wu, Siddhartha Laghuvarapu, Jathurshan Pradeepkumar, Jimeng Sun2026-05-01
🤖 AI

Descriptor: Parasitoid Wasps and Associated Hymenoptera Dataset (DAPWH)

यह शोध पत्र DAPWH डेटासेट प्रस्तुत करता है, जो नियोट्रोपिकल परजीवी ततैया (Neotropical parasitoid wasps) और संबंधित हाइमेनॉप्टेरा (Hymenoptera) की 3,556 उच्च-रिज़ॉल्यूशन वाली छवियों का एक क्यूरेटेड संग्रह है, जिसमें 1,739 COCO-एनोटेटेड छवियां शामिल हैं, ताकि इन पारिस्थितिक रूप से महत्वपूर्ण लेकिन रूपात्मक रूप से चुनौतीपूर्ण कीटों के लिए स्वचालित वर्गीकरण पहचान प्रणालियों के विकास को सुगम बनाया जा सके।

Joao Manoel Herrera Pinheiro, Gabriela Do Nascimento Herrera, Luciana Bueno Dos Reis Fernandes, Alvaro Doria Dos Santos (…)2026-05-01
💻 computer science

The Impact of LLM Self-Consistency and Reasoning Effort on Automated Scoring Accuracy and Cost

यह अध्ययन प्रदर्शित करता है कि जहाँ रणनीतिक मॉडल चयन और बढ़े हुए तर्क प्रयास (reasoning effort) उच्च विद्यालय गणित चर्चाओं के लिए स्वचालित स्कोरिंग सटीकता को महत्वपूर्ण रूप से बढ़ाते हैं, वहीं सेल्फ-कंसिस्टेंसी (self-consistency) के माध्यम से एंसेम्बलिंग से कोई पर्याप्त लाभ नहीं होता है, जिसमें विशिष्ट कम-लागत वाले मॉडल प्रदर्शन और व्यय के बीच इष्टतम संतुलन प्रदान करते हैं।

Scott Frohn2026-05-01
💻 computer science

Policy-Governed LLM Routing with Intent Matching for Instrument Laboratories

यह शोध पत्र Routiium और EduRouter को प्रस्तुत करता है, जो इंजीनियरिंग लैब्स के लिए एक नीति-शासित (policy-governed) LLM रूटिंग सिस्टम है, जो मॉडल चयन को गतिशील रूप से प्रबंधित करके, बजट लागू करके और छात्रों के इरादों (intents) का मिलान करके, निर्देशात्मक चुनौती और लागत के बीच संतुलन बनाता है, जिससे सिम्युलेटेड और लाइव मूल्यांकन में सीखने के संरेखण (learning alignment) में महत्वपूर्ण सुधार होता है और टोकन खर्च कम होता है।

Emmanuel A. Olowe, Danial Chitnis2026-05-01
💻 computer science

CareGuardAI: Context-Aware Multi-Agent Guardrails for Clinical Safety & Hallucination Mitigation in Patient-Facing LLMs

CareGuardAI एक संदर्भ-जागरूक, मल्टी-एजेंट फ्रेमवर्क है जो दोहरी जोखिम मूल्यांकन (SRA और HRA) के साथ एक मल्टी-स्टेज इन्फरेंस पाइपलाइन का उपयोग करके, रिलीज से पहले प्रतिक्रियाओं को फ़िल्टर और परिष्कृत करके क्लिनिकल सुरक्षा सुनिश्चित करता है और पेशेंट-फेसिंग LLMs में मतिभ्रम (hallucinations) को कम करता है।

Elham Nasarian, Abhilash Neog, Kwok-Leung Tsui, Niyousha HosseiniChimeh2026-05-01