📊 statistics

Sequential Correlations Change In-Context Learning: Effective Context Length and Architectural Mismatch

यह शोधपत्र इन-कॉन्टेक्स्ट लर्निंग थ्योरी को अनुक्रमिक रूप से सह-संबंधित डेटा (sequentially correlated data) तक विस्तारित करता है, जो यह प्रकट करता है कि ऐसे सहसंबंध प्रभावी कॉन्टेक्स्ट लंबाई को कम कर देते हैं जब क्वेरी स्वतंत्र होती हैं, लेकिन टेस्ट एरर में सुधार करते हैं जब क्वेरी भी सह-संबंधित होती हैं, जिससे लीनियर और सॉफ्टमैक्स अटेंशन आर्किटेक्चर के बीच इष्टतम चयन प्रभावित होता है।

Mary Letey, Yue M. Lu, Cengiz Pehlevan, Jacob Zavatone-Veth2026-07-07
🤖 AI

Self-Improving Diffusion Classifiers with Minority Preference Optimization

यह शोध पत्र MiPO को प्रस्तुत करता है, जो एक ऐसी विधि है जो अतिरिक्त इमेज डेटा या बाहरी रिवॉर्ड मॉडल की आवश्यकता के बिना, अल्पसंख्यकीय डेटा वितरण के प्रति धारणा में सुधार करने के लिए अल्पसंख्यक प्राथमिकता अनुकूलन (minority preference optimization) के साथ पूर्व-प्रशिक्षित मॉडलों को फाइन-ट्यून करके डिफ्यूजन मॉडल्स के अल्पसंख्यक क्षेत्रों में ज़ीरो-शॉट वर्गीकरण प्रदर्शन को बढ़ाता है।

Hyunsoo Kim, Jungmyung Wi, Soobin Um, Donghyun Kim, Suhyun Kim2026-07-07
💬 NLP

Punching Above Their Weight: Classification-Head Fine-Tuning of Tiny Language Models (TLMs) for Verifiable Multiple-Choice Tasks

यह शोध पत्र प्रदर्शित करता है कि एक डिस्क्रिमिनेटिव क्लासिफिकेशन हेड के साथ छोटे भाषा मॉडलों (3B पैरामीटर्स से कम) को फाइन-ट्यून करना लेबल जनरेशन दृष्टिकोणों की तुलना में काफी बेहतर प्रदर्शन करता है, जो मल्टी-चॉइस बेंचमार्क पर अत्याधुनिक परिणाम प्राप्त करता है और बहुत बड़े ज़ीरो-शॉट मॉडलों का मुकाबला करता है।

Bhavesh Sood, Jaromir Savelka2026-07-07
📊 statistics

Stable Global Weighting of Flow Mixtures using Simplex Exponential Moving Average

यह शोध पत्र AMF-VI-sEMA प्रस्तुत करता है, जो एक दो-चरणीय ढांचा है जो विविध विशेषज्ञों को स्वतंत्र रूप से प्रशिक्षित करके और फिर विषम ज्यामिति (heterogeneous geometries) के बीच मजबूत पश्च वितरण सन्निकटन (posterior approximation) प्राप्त करने के लिए सिम्प्लेक्स एक्सपोनेंशियल मूविंग एवरेज के माध्यम से एक स्थिर, डेटा-अज्ञेय वैश्विक भारिंग तंत्र लागू करके नॉर्मलाइजिंग फ्लो मिश्रणों को बढ़ाता है, जिससे घटक पतन (component collapse) को रोका जा सके।

Benjamin Wiriyapong, Oktay Karakus, Can Eyupoglu, Kirill Sidorov2026-07-07
🤖 machine learning

Weave: Verified Netlist-to-Schematic Conversion via Layered Graph Layout

वीव (Weave) एक नियतात्मक (deterministic), क्लाइंट-साइड टूल है जो लेयर्ड ग्राफ लेआउट का उपयोग करके SPICE नेटलिस्ट को LTspice स्कीमैटिक्स में परिवर्तित करता है और एक कठोर राउंड-ट्रिप सत्यापन प्रक्रिया के माध्यम से 100% कनेक्टिविटी सटीकता की गारंटी देता है, जो मानक और बड़े पैमाने के सर्किट बेंचमार्क पर संभाव्य लर्निंग-आधारित दृष्टिकोणों की तुलना में काफी बेहतर प्रदर्शन करता है।

Senol Gulgonul2026-07-07
🤖 machine learning

A Unified Framework for Quantized and Continuous Strong Lottery Tickets

यह शोध पत्र स्ट्रॉन्ग लॉटरी टिकट हाइपोथेसिस के लिए एक एकीकृत ढांचे को प्रस्तुत करता है जो टाइट क्वांटाइज्ड गारंटी प्राप्त करने के लिए डिस्क्रीट सेटिंग्स में रैंडम सबसेट सम प्रॉब्लम का विश्लेषण करता है, जो पूर्व परिणामों में घातांकीय रूप से सुधार करता है और स्वाभाविक रूप से निरंतर और क्वांटाइज्ड दोनों प्रतिमानों को सीमित मामलों के रूप में समाहित करता है।

Aakash Kumar, Emanuele Natale2026-07-07
💬 NLP

Evaluating LLM Uncertainty in Long-Form Generation Using Deterministic Ground Truth

यह शोध पत्र SALT प्रस्तुत करता है, जो दीर्घ-रूप (long-form) LLM जनरेशन के मूल्यांकन के लिए नियत ग्राउंड ट्रुथ्स (deterministic ground truths) वाला एक बेंचमार्क है, जो यह प्रकट करता है कि जहाँ तर्क (reasoning) सटीकता में सुधार करता है, वहीं यह आत्मविश्वास रैंकिंग (confidence ranking) को कम करता है, और त्रुटि प्रसार (error propagation) भ्रष्ट प्रीफिक्स (corrupted prefixes) और बढ़ते उत्तर-संदर्भ लंबाई (answer-context length) दोनों से प्रेरित होता है।

Ido Amit, Ido Galil, Ran El-Yaniv2026-07-07
📊 statistics

A Gradient Flow Perspective on Minimum MMD Estimation

यह शोधपत्र न्यूनतम MMD अनुमान के लिए एक प्रीकंडीशन्ड ग्रेडिएंट डिसेंट स्कीम प्रस्तावित करता है जो स्पष्ट शर्तों के तहत एसिम्प्टोटिक ग्लोबल कन्वर्जेंस स्थापित करता है और चुनौतीपूर्ण पैरामीटर अनुमान और परिकल्पना परीक्षण कार्यों में मानक ग्रेडिएंट डिसेंट की तुलना में बेहतर अनुभवजन्य प्रदर्शन प्रदर्शित करता है।

Sophia Seulkee Kang, Louis Sharrock, Xiaoyuan Cheng, François-Xavier Briol, Zonghao Chen2026-07-07
🤖 machine learning

USE: A Unified Self-Ensembling Framework for Test-Time Prompt Tuning

यह शोध पत्र USE का प्रस्ताव करता है, जो एक एकीकृत स्व-एन्सेम्बलिंग फ्रेमवर्क है जो विश्वसनीय छद्म लेबल (pseudo labels) उत्पन्न करने के लिए मूल परीक्षण छवियों पर अनुकूल रूप से बल देकर टेस्ट-टाइम प्रॉम्प्ट ट्यूनिंग में सुधार करता है, जिससे अनुकूलन और अनुमान चरणों के बीच निरंतरता सुनिश्चित होती है और साथ ही यह एक हल्के अनुकूलन-रहित अनुकूलन पद्धति के रूप में भी कार्य करता है।

Siru Jiang, Jian Liang, Ran He, Tieniu Tan2026-07-07
⚛️ general relativity

Transformers with Physics-Informed Encodings and Simulation-Based Inference for Robust Detection of Eccentric Binary Black Holes in Pulsar Timing Array Data

यह शोध पत्र एक नवीन ढांचे को प्रस्तुत करता है जो पल्सर टाइमिंग एरे डेटा में उत्केंद्रित (eccentric) बाइनरी ब्लैक होल्स का कुशलतापूर्वक और सटीक रूप से पता लगाने के लिए भौतिकी-सूचित ट्रांसफॉर्मर (physics-informed Transformers) को सिमुलेशन-आधारित अनुमान (simulation-based inference) के साथ जोड़ता है, जो मॉडल की वास्तुकला में सीधे विश्लेषणात्मक गुरुत्वाकर्षण तरंग भौतिकी को समाहित करके पारंपरिक बेयसियन विधियों के एक स्केलेबल विकल्प के रूप में कार्य करता है।

Subhajit Dandapat, Alvin J. K. Chua2026-07-07✓ Author reviewed