⚡ electrical engineering

Steering Robustness into World Action Models via Mechanistic Interpretability and Optimal Control

यह शोध पत्र WA-LQR नामक एक प्रशिक्षण-मुक्त स्टीयरिंग पद्धति प्रस्तावित करता है जो उनके सक्रियण स्थानों (activation spaces) में निम्न-आयामी रैखिक पृथक्करणीयता (low-dimensional linear separability) का लाभ उठाकर वर्ल्ड एक्शन मॉडल्स की वितरण बदलावों (distribution shifts) के विरुद्ध सुदृढ़ता बढ़ाने के लिए यांत्रिक व्याख्यात्मकता (mechanistic interpretability) और इष्टतम नियंत्रण (optimal control) का उपयोग करता है।

Jihoon Hong, Julian Skifstad, Qiyue Dai, Alice Chan, Glen Chou2026-07-17
🤖 machine learning

Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation

यह शोध पत्र मल्टी-एक्सिस मैक्स@के (multi-axis max@K) का परिचय देता है, जो एक समूह-आधारित सुदृढीकरण शिक्षण (reinforcement learning) उद्देश्य है जो टेक्स्ट-टू-इमेज जनरेशन की विविधता और जनसांख्यिकीय निष्पक्षता को बढ़ाता है, क्योंकि यह क्रेडिट केवल तभी नमूनों को प्रदान करता है जब वे एक बैच के भीतर विशिष्ट सिमेंटिक मोड्स (semantic modes) के कवरेज में अद्वितीय सुधार करते हैं, जिससे छवि गुणवत्ता या प्रॉम्प्ट संरेखण से समझौता किए बिना उच्च निष्पक्षता स्कोर प्राप्त होता है।

Ku Onoda, Paavo Parmas, Hiroki Furuta, Soichiro Nishimori, Yuta Oshima, Shohei Taniguchi, Yutaka Matsuo2026-07-17
💬 NLP

Latent Trajectory Discrimination for AI-Generated Text Detection

यह शोध पत्र ज्योमेट्रिक ट्रैजेक्टरी और कॉन्ट्रास्टिव लर्निंग (GTCL) का प्रस्ताव करता है, जो एक नवीन ढांचा है जो स्थिर दस्तावेज़ एम्बेडिंग पर निर्भर रहने के बजाय अनुक्रमों (sequences) के माध्यम से पाठ्य निरूपणों (textual representations) के गतिशील विकास को मॉडल करके AI-जनित टेक्स्ट डिटेक्शन में सुधार करता है, जिससे कई बेंचमार्क पर बेहतर प्रदर्शन प्राप्त होता है।

Gianluca Bonifazi, Christopher Buratti, Michele Marchetti, Federica Parlapiano, Giulia Quaglieri, Davide Traini, Domenic (…)2026-07-17
🤖 AI

Explaining Process Control Optimisation Recommendations via GradientSHAP and Implicit Differentiation

यह शोध पत्र एक वास्तविक समय (real-time) व्याख्यात्मक एआई (explainable AI) ढांचे का प्रस्ताव करता है जो औद्योगिक प्रक्रिया नियंत्रण अनुकूलन के लिए सटीक, प्राकृतिक भाषा व्याख्याएं उत्पन्न करने हेतु इम्प्लिसिट फंक्शन थ्योरम-आधारित संवेदनशीलता विश्लेषण को SHAP एट्रिब्यूशन और लार्ज लैंग्वेज मॉडल्स के साथ जोड़ता है, जो ऑपरेटर-केंद्रित अंतर्दृष्टि में उच्च निष्ठा बनाए रखते हुए पारंपरिक तरीकों की तुलना में 40 गुना से अधिक की गति वृद्धि प्राप्त करता है।

Paul Darm, Cem Alpturk, Kenneth Ulrich, William Duncan, Ali Anwar, Annalisa Riccardi2026-07-17
🤖 AI

Demographically-Conditioned Synthetic Medical Images for Bias Mitigation and Bias Detection in Disease Classifiers

यह शोध पत्र प्रीट्रेनिंग के माध्यम से प्रशिक्षण पूर्वाग्रह (training bias) को कम करने और मेडिकल इमेज क्लासिफायर में मूल्यांकन पूर्वाग्रह (evaluation bias) का पता लगाने के लिए एक जनसांख्यिकीय-सशर्त सिंथेटिक जनरेटर (demographically-conditioned synthetic generator) का उपयोग करने का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि सिंथेटिक अल्पसंख्यक समूह (synthetic minority cohorts) नमूना-आकार की सीमाओं को दूर करने के लिए क्लासिफायर की दक्षता में सुधार कर सकते हैं और वहां विश्वसनीय निष्पक्षता ऑडिट प्रदान कर सकते हैं जहाँ वास्तविक डेटा दुर्लभ है।

Mahmoud Ibrahim, Bart Elen, Chang Sun, Gokhan Ertaylan, Michel Dumontier2026-07-17
💬 NLP

OmniaBench: Benchmarking General AI Agents Across Diverse Scenarios

OmniaBench एक व्यापक बेंचमार्क है जिसे वास्तविक दुनिया के संसाधनों से प्राप्त एक पदानुक्रमित वर्गीकरण का लाभ उठाकर विविध ToC, ToB और ToE परिदृश्यों में सामान्य AI एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो स्पष्ट स्टेट स्पेस के साथ 1,431 निष्पादन योग्य कार्यों का निर्माण करता है, जिससे योजना बनाने (planning), बाधा बनाए रखने (constraint maintenance) और अनुकूलनशील सुधार (adaptive correction) के संबंध में वर्तमान फ्रंटियर मॉडल्स की महत्वपूर्ण सीमाओं का पता चलता है।

Chengyu Shen, Yujie Fu, Gangtao Xin, Yanheng Hou, Wenlong Fei, Guojie Zhu, Jiawei Li, Hongcheng Gao, Runming He, Zhen Ha (…)2026-07-17
⚛️ lattice

LQCDMaster: Agentic Scientific Computing for Lattice Quantum Chromodynamics Research

यह शोध पत्र LQCDMaster को प्रस्तुत करता है, जो एक एजेंटिक वैज्ञानिक कंप्यूटिंग प्रणाली है जो प्राकृतिक-भाषा लैटिस QCD अनुसंधान कार्यों को निष्पादनीय PyQUDA वर्कफ़्लो में बदलने को स्वचालित करती है, जिससे संख्यात्मक सटीकता बनाए रखते हुए और नवीन वैज्ञानिक गणनाओं की खोज को सक्षम करते हुए कार्यान्वयन समय में महत्वपूर्ण कमी आती है।

Haofei Gao, Tingjia Miao, Wenkai Jin, Muhua Zhang, Hanzhang Wang, Jie Ran, Jinxin Tan, Zhentao Zhang, Bo Tang, Leiyi Li (…)2026-07-17
🤖 AI

Man, Machine, and Masterpiece: Artistic Ownership in the AI Era

यह शोध पत्र आर्टस्प्लिट (ArtSplit) प्रस्तुत करता है, जो रचनात्मक कार्यप्रवाहों में मानवीय और एआई योगदान को मापने के लिए बनाया गया एक प्रोवोटाइप (provotype) है, ताकि यह प्रदर्शित किया जा सके कि कलात्मक स्वामित्व को मापने योग्य कार्यों तक सीमित करना कलाकारों की इरादे और एजेंसी की अवधारणाओं के साथ तालमेल बिठाने में विफल रहता है, जिससे जटिल सामाजिक संबंधों को तकनीकी समस्याओं के रूप में मानने की प्रवृत्ति को चुनौती मिलती है।

Sofi Gjing Jovanovska, Kuntal Ghosh, Daniel Muhu Njenga, Ahmed Mufassir, Shadan Sadeghian2026-07-17
🤖 machine learning

Parameter-efficient Prompt Tuning of Vision Foundation Model With Adaptive Focal Loss for Interpretable MCI Screening

यह शोध पत्र एक पैरामीटर-कुशल ढांचे का प्रस्ताव करता है जो डेटा की कमी और वर्ग असंतुलन से पार पाने के लिए सीखने योग्य प्रॉम्प्ट टोकन और एक अनुकूली फोकल लॉस का उपयोग करके एक फ्रोजन DINOv2-Small मॉडल को अनुकूलित करता है, ताकि न्यूरोसाइकोलॉजिकल ड्राइंग टेस्ट से माइल्ड कॉग्निटिव इम्पेयरमेंट की आंतरिक रूप से व्याख्या योग्य, उच्च-प्रदर्शन वाली स्क्रीनिंग सक्षम की जा सके।

Javad Khoramdel, Farhad Hoseyni, Amirhossein Nikoofard2026-07-17
🤖 AI

Towards Hierarchical Structure Understanding of Newspaper Images

यह शोध पत्र एक मॉड्यूलर बॉटम-अप पाइपलाइन और 'तिरामिसु' (Tiramisu) नामक एक नवीन एंड-टू-एंड ट्रांसफार्मर आर्किटेक्चर के रूप में दो पूरक दृष्टिकोणों का प्रस्ताव करते हुए जटिल समाचार पत्र लेआउट को समझने की चुनौती को संबोधित करता है—साथ ही ऐतिहासिक समाचार पत्रों में पदानुक्रमित सूचना पुनर्प्राप्ति का मूल्यांकन करने के लिए एक नया डेटासेट, 'फिनलम ला लिबर्टी' (Finlam La Liberté) पेश करता है।

William Mocaër, Solène Tarride, Thomas Constum, Merveilles Agbeti-Messan, Tom Simon, Clément Chatelain, Stéphane Nicolas (…)2026-07-17