🤖 machine learning

The Hidden Cost of Resampling: How Imbalance Correction Degrades Probability Calibration in Tree Ensembles

यह शोध पत्र यह प्रदर्शित करता है कि जबकि SMOTE ट्री एन्सेंबल्स (tree ensembles) में प्रायिकता अंशांकन (probability calibration) को थोड़ा कम करता है, रैंडम अंडरसैंपलिंग (random undersampling) उच्च असंतुलन अनुपात पर गंभीर अंशांकन त्रुटियां उत्पन्न करता है, लेकिन इन दोनों समस्याओं को रैंकिंग प्रदर्शन से महत्वपूर्ण रूप से समझौता किए बिना पोस्ट-हॉक रीकैलिब्रेशन (post-hoc recalibration) के माध्यम से प्रभावी ढंग से हल किया जा सकता है।

Zewen Liu2026-06-30
🤖 machine learning

Redefining Maritime Anomaly Detection via Equation-Grounded Synthetic Anomalies

यह शोध पत्र एक समीकरण-आधारित वर्गीकरण और एक एकीकृत पाइपलाइन का प्रस्ताव करके समुद्री विसंगति डेटा की कमी को संबोधित करता है, जो टाइमस्टैम्प-स्तर के लेबल वाले विसंगतियों को संश्लेषित करता है, जिससे एकल-पोत और अंतर-पोत परिदृश्यों में विविध पहचान मॉडलों के व्यवस्थित मूल्यांकन को सक्षम बनाया जा सके।

Youngseok Hwang, Sungho Bae, Dohun Lee, Jaeeun Seo, Jeehong Kim, Wonhee Lee, Hyunwoo Park2026-06-30
🤖 machine learning

Simplifying Flow Matching Transformations with Low-Rank Mixture Models

यह शोध पत्र जटिल डेटा वितरणों के साथ बेहतर तालमेल बिठाने के लिए नॉर्मलाइजिंग फ्लो के लिए लेटेंट डेंसिटी के रूप में मिक्सचर ऑफ प्रोबेबिलिस्टिक प्रिंसिपल कंपोनेंट एनालाइज़र (MPPCA) का उपयोग करने का प्रस्ताव करता है, जिससे मानक सामान्य बेसलाइन की तुलना में सीखी गई रूपांतरणों को सरल बनाया जा सके, प्रशिक्षण अभिसरण को त्वरित किया जा सके और जनरेटिव प्रदर्शन में सुधार किया जा सके।

Liam A. Kruse, Houjun Liu, Alexandros E. Tzikas, Mansur M. Arief, Mykel J. Kochenderfer2026-06-30
🤖 machine learning

Rethinking Generative Reconstruction Attacks against Graph Neural Network Models

यह शोध पत्र दो नवीन ग्राफ इनवर्जन हमलों, ग्राफ-लेबल कंडिशनड (GLC) और एम्बेडिंग-लेबल कंडिशनड (ELC) को प्रस्तुत करता है, जो ब्लैक-बॉक्स परिदृश्यों में ग्राफ न्यूरल नेटवर्क मॉडलों से उच्च गुणवत्ता वाले ग्राफ को सफलतापूर्वक पुनर्निर्मित करने के लिए जनरेटर-डिस्क्रिमिनेटर तकनीकों का लाभ उठाते हैं, जिससे विभिन्न डेटासेट और शोर की स्थितियों में जीएनएन (GNN) गोपनीयता में महत्वपूर्ण कमजोरियों का प्रदर्शन होता है।

Adebayo Keji, Sayanton Dibbo2026-06-30
🤖 machine learning

PS-PPO: Prefix-Sampling PPO for Critic-Free RLHF

यह शोध पत्र PS-PPO का प्रस्ताव करता है, जो एक कंप्यूट-कुशल क्रिटिक-मुक्त (critic-free) RLHF विधि है जो केवल यादृच्छिक रूप से नमूना लिए गए प्रक्षेपवक्र उपसर्गों (trajectory prefixes) के माध्यम से बैकप्रोपैगेट करके और एक निष्पक्ष ग्रेडिएंट एस्टिमेटर बनाए रखने के लिए महत्व भारण (importance weighting) का उपयोग करके प्रशिक्षण लागत और मेमोरी उपयोग को कम करता है।

Doo Hwan Hwang, Kee-Eung Kim2026-06-30
💰 quantitative finance

CLQT: A Closed-Loop, Cost-Aware, Strategy-Consistent Benchmark for Diagnostic Evaluation of LLM Portfolio-Management Agents

यह शोध पत्र CLQT को प्रस्तुत करता है, जो एक क्लोज्ड-लूप, लागत-जागरूक और रणनीति-संगत बेंचमार्क है जो LLM पोर्टफोलियो-प्रबंधन एजेंटों के मूल्यांकन को सरल रिटर्न-आधारित रैंकिंग से बदलकर एक नैदानिक ढांचे में परिवर्तित करता है जो विशिष्ट तर्क विफलताओं को अलग करने और एक सत्यापन योग्य, बहु-चरणीय ट्रेडिंग चक्र के माध्यम से टिकाऊ दक्षताओं को मापने में सक्षम है।

Bo Qu, Mingguang Chen2026-06-30
🤖 machine learning

MemLeak: Diagnosing Information Leaks in Multimodal Agent Memory

यह शोध पत्र MemLeak, एक बेंचमार्क और इंफॉर्मेशन प्रोवेनेंस ग्राफ वर्गीकरण को प्रस्तुत करता है, यह प्रदर्शित करने के लिए कि मल्टीमॉडल एआई एजेंट अक्सर जानकारी को वास्तव में "भूलने" में विफल रहते हैं क्योंकि टेक्स्ट हटाने के बाद भी तथ्य रिटेन की गई छवियों से रिकवरेबल रहते हैं, जिससे इन लीक्स को कम करने के लिए कंटेंट-अवेयर सिमेंटिक डिलीशन की आवश्यकता होती है।

Kuan Wang, Chao Zhang2026-06-30
📊 statistics

What Drives the Inlier-Memorization Effect? A Theory of Outlier Detection via Early Training Dynamics

यह शोधपत्र ऑटोएनकोडर्स में प्रारंभिक प्रशिक्षण गतिकी का विश्लेषण करके आउटलायर डिटेक्शन (outlier detection) में इनलियर-मेमोराइजेशन प्रभाव (inlier-memorization effect) के लिए एक सैद्धांतिक आधार प्रदान करता है ताकि इस घटना के उद्भव और निरंतरता को स्पष्ट किया जा सके, और अंततः व्यावहारिक दिशा-निर्देश प्राप्त किए जा सकें जो बेंचमार्क डेटासेट्स पर अत्याधुनिक प्रदर्शन (state-of-the-art performance) प्राप्त करते हैं।

Kunwoong Kim, Dongha Kim2026-06-30
🤖 machine learning

Multi-Level Distributional Entropy for Explainable Network Intrusion Detection

यह शोध पत्र मल्टी-लेवल डिस्ट्रीब्यूशनल एंट्रॉपी (MDE) प्रस्तुत करता है, जो एक व्याख्या योग्य ढांचा है जो कच्चे पैकेट डेटा या प्रशिक्षण की आवश्यकता के बिना प्रभावी और पुनरुत्पादनीय नेटवर्क घुसपैठ का पता लगाने में सक्षम होने के लिए फ्लो-स्तरीय सांख्यिकी से सीधे एंट्रॉपी-आधारित विशेषताओं को व्युत्पन्न करता है, साथ ही यह उन महत्वपूर्ण प्रदर्शन विफलताओं को भी प्रकट करता है जो समग्र मेट्रिक्स द्वारा छिपाई जाती हैं।

Mohamed Aly Bouke, Md Shohel Sayeed, Swee-Huay Heng, Azizol Abdullah, Mohamed Othman2026-06-30
🤖 machine learning

The Forgetting-Retention Dilemma: Certified Unlearning Theory in Continual Learning

यह शोध पत्र ऐतिहासिक ज्ञान को संरक्षित करने और लक्षित विस्मरण (targeted forgetting) के बीच एक ट्रेड-ऑफ को सूत्रबद्ध करके, गैर-उत्तल (non-convex) मॉडलों के लिए जोखिम सीमाओं को व्युत्पन्न करके, और भंडारण दक्षता एवं अनलर्निंग प्रदर्शन के बीच संतुलन बनाने वाली एक हाइब्रिड रणनीति प्रस्तावित करके, निरंतर शिक्षण (continual learning) और मशीन अनलर्निंग के बीच सेतु बनाने वाला पहला सैद्धांतिक आधार स्थापित करता है।

Yiting Hu, Lingjie Duan, Qian Zhang2026-06-30