📊 statistics

Similarity as Reward Alignment: Robust and Versatile Preference-based Reinforcement Learning

यह शोध पत्र सिमिलैरिटी एज़ रिवॉर्ड अलाइनमेंट (SARA) को प्रस्तुत करता है, जो प्राथमिकता-आधारित सुदृढीकरण शिक्षण (preference-based reinforcement learning) के लिए एक सुदृढ़ कंट्रास्टिव फ्रेमवर्क है जो रिवॉर्ड्स की गणना समानता के रूप में करने के लिए लेटेंट रिप्रेजेंटेशन सीखता है, और निरंतर नियंत्रण बेंचमार्क (continuous control benchmarks) पर बेसलाइन्स की तुलना में बेहतर स्थिरता और शोर प्रतिरोध (noise resilience) प्रदर्शित करता है।

Sara Rajaram, R. James Cotton, Fabian H. Sinz2026-07-17
🤖 AI

AgenticData: An Agentic Data Analytics System for Heterogeneous Data

AgenticData एक अभिनव एजेंटिक प्रणाली है जो फीडबैक-संचालित योजना और सिमेंटिक अनुकूलन के साथ मल्टी-एजेंट सहयोग रणनीति का लाभ उठाकर प्राकृतिक भाषा प्रश्नों के माध्यम से विषम संरचित और असंरचित डेटा के स्वायत्त विश्लेषण को सक्षम बनाती है ताकि मौजूदा तरीकों की तुलना में श्रेष्ठ सटीकता प्राप्त की जा सके।

Ji Sun, Guoliang Li, Peiyao Zhou, Yihui Ma, Jingzhe Xu, Yuan Li2026-07-17
🔬 physics

Energy-Efficient Federated Learning via Adaptive Encoder Freezing for MRI-to-CT Conversion: A Green AI-Guided Research

यह शोध पत्र एमआरआई-से-सीटी रूपांतरण के लिए फेडरेटेड लर्निंग हेतु एक ग्रीन एआई-निर्देशित अनुकूली एनकोडर फ्रीजिंग रणनीति प्रस्तावित करता है जो मॉडल प्रदर्शन को बनाए रखते हुए या उसमें सुधार करते हुए ऊर्जा खपत और CO2 उत्सर्जन को 23% तक काफी कम कर देता है, जिससे न्यायसंगत और टिकाऊ स्वास्थ्य सेवा एआई को बढ़ावा मिलता है।

Ciro Benito Raggio, Lucia Migliorelli, Nils Skupien, Mathias Krohmer Zabaleta, Oliver Blanck, Francesco Cicone, Giuseppe (…)2026-07-17
🤖 AI

Gaussian Process Aggregation for Root-Parallel Monte Carlo Tree Search with Continuous Actions

यह शोध पत्र निरंतर एक्शन स्पेस (continuous action spaces) में रूट-पैरेलल मोंटे कार्लो ट्री सर्च के लिए एक गॉसियन प्रोसेस-आधारित एकत्रीकरण विधि प्रस्तावित करता है, जो अनुमान समय में मामूली वृद्धि के साथ ही अनट्राइड (untried) एक्शन्स के मूल्यों का प्रभावी ढंग से अनुमान लगाकर छह डोमेन में मौजूदा रणनीतियों से बेहतर प्रदर्शन करता है।

Junlin Xiao, Victor-Alexandru Darvariu, Bruno Lacerda, Nick Hawes2026-07-17
💬 NLP

Step-Tagging: Toward controlling the generation of Language Reasoning Models through step monitoring

यह शोध पत्र स्टेप-टैगिंग (Step-Tagging) का परिचय देता है, जो एक नवीन रीजनिंग स्टेप टैक्सोनॉमी (ReasonType) का उपयोग करने वाला एक हल्का फ्रेमवर्क है ताकि लैंग्वेज रीजनिंग मॉडल्स की रियल-टाइम मॉनिटरिंग और अर्ली स्टॉपिंग को सक्षम बनाया जा सके, जिससे गणितीय और गैर-गणितीय बेंचमार्क में तुलनीय सटीकता बनाए रखते हुए टोकन जनरेशन में 20-50% की कमी हासिल की जा सके।

Yannis Belkhiter, Seshu Tirupathi, Giulio Zizzo, John D. Kelleher2026-07-17
💰 quantitative finance

Large language models can effectively convince people to believe conspiracies

यह अध्ययन दर्शाता है कि जहाँ बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) अपने निर्देशों के आधार पर लोगों को साजिश संबंधी सिद्धांतों (कॉन्सपिरेसी थ्योरीज) में विश्वास दिलाने या न दिलाने में समान रूप से प्रभावी हो सकते हैं, वहीं सटीक सूचनात्मक सुरक्षा उपायों (गार्डरेल्स) को लागू करना और विशिष्ट मॉडल क्षमताओं का लाभ उठाना एआई-संचालित गलत सूचना के जोखिम को काफी हद तक कम कर सकता है।

Thomas H. Costello, Kellin Pelrine, Matthew Kowal, Jasper Timm, Antonio A. Arechar, Jean-François Godbout, Adam Gleave (…)2026-07-17
🤖 AI

Quality-Aware Robust Multi-View Clustering for Heterogeneous Observation Noise

यह शोध पत्र क्वालिटी-अवेयर रोबस्ट मल्टी-व्यू क्लस्टरिंग (QARMVC) का प्रस्ताव करता है, जो एक नवीन ढांचा है जो पुनर्निर्माण विसंगतियों (reconstruction discrepancies) के माध्यम से इंस्टेंस-स्तरीय डेटा गुणवत्ता को मात्रात्मक रूप से निर्धारित करके विषम अवलोकन शोर (heterogeneous observation noise) को संबोधित करता है और शोर प्रसार को अनुकूल रूप से दबाने तथा एक सुदृढ़ वैश्विक सर्वसम्मति बनाने के लिए एक पदानुक्रमित शिक्षण रणनीति में इन स्कोर को एकीकृत करता है।

Peihan Wu, Guanjie Cheng, Yufei Tong, Meng Xi, Shuiguang Deng2026-07-17
🤖 machine learning

Automated identification of Ichneumonoidea wasps via YOLO-based deep learning: Integrating HiresCam for Explainable AI

यह अध्ययन उच्च-रिज़ॉल्यूशन वाली छवियों से इचneumonoidea (Ichneumonoidea) ततैया परिवारों की स्वचालित, व्याख्या योग्य पहचान प्राप्त करने के लिए हाई-रिज़ॉल्यूशन क्लास एक्टिवेशन मैपिंग (HiResCAM) के साथ एकीकृत एक YOLO-आधारित डीप लर्निंग फ्रेमवर्क प्रस्तुत करता है, जिससे जैव विविधता और जैविक नियंत्रण कार्यक्रमों में मैनुअल वर्गीकरण संबंधी चुनौतियों का समाधान किया जा सके और 96% से अधिक सटीकता प्राप्त की जा सके।

Joao Manoel Herrera Pinheiro, Gabriela Do Nascimento Herrera, Alvaro Doria Dos Santos, Luciana Bueno Dos Reis Fernandes (…)2026-07-17
🤖 AI

RegNetAgents: A Multi-Agent Framework for Cross-Network Regulatory Driver Identification in Cancer Genomics

RegNetAgents एक AI-संचालित मल्टी-एजेंट फ्रेमवर्क है जो उच्च सांख्यिकीय महत्व और जैविक प्रासंगिकता के साथ कैंसर-विशिष्ट नियामक चालकों (regulatory drivers) को व्यवस्थित रूप से पहचानने, रैंक करने और व्याख्या करने के लिए बल्क ट्यूमर और सिंगल-सेल जीन रेगुलेटरी नेटवर्क को एकीकृत करता है।

Jose A. Bird2026-07-17
💬 NLP

LBA: Textual Hard-Label Adversarial Attack under Low Query Budgets

यह शोध पत्र LBA का प्रस्ताव करता है, जो एक सैंपलिंग-आधारित विधि है जो उच्च-गुणवत्ता वाले प्रतिकूल उदाहरणों (एडवर्सरियल एग्जांपल्स) के एक अनुमानित वितरण का निर्माण करने के लिए पूर्व (प्रायर) और पश्चात (पोस्टीरियर) ज्ञान को पुनरावृत्ति से एकीकृत करती है, जिससे यह कम क्वेरी बजट के तहत अर्थपूर्ण रूप से संरक्षित हार्ड-लेबल एडवर्सरियल टेक्स्ट उत्पन्न करने में मौजूदा ग्रीडी दृष्टिकोणों से काफी बेहतर प्रदर्शन करता है।

Shixin Guo, Ming Zhong, Xuhong Zhang, Dandan Zhao, Zhe Wang, Bo Zhang, Shouling Ji, Hao Peng2026-07-17