💬 NLP

Beyond the Mean: Three-Axis Fidelity for Aligning LLM-Based Survey Simulators from Small Pilot Data

यह शोध पत्र LLM-आधारित सर्वेक्षण सिम्युलेटरों का मूल्यांकन करने के लिए एक त्रि-अक्षीय निष्ठा ढांचे (संरचनात्मक, सीमांत और व्यक्तिगत) का प्रस्ताव करता है और यह प्रदर्शित करता है कि छोटे पायलट नमूनों पर फाइन-ट्यूनिंग करना जनसंख्या-स्तरीय सांख्यिकीय विशेषताओं को पुनः प्राप्त करने के लिए एक संतुलित दृष्टिकोण प्रदान करता है, हालांकि निष्ठा उप-नमूनों में भिन्न हो सकती है।

Eun Cheol Choi, Youngrae Kim, Prabhu Pugalenthi, Hong-En Chen, Bo-Ruei Huang2026-06-30
💻 computer science

Evidence-Based Text-Conditioned 3D CT Synthesis for Ovarian Cancer

यह शोध पत्र OvESyn को प्रस्तुत करता है, जो एक नवीन ढांचा है जो इमेजिंग डिस्क्रिप्टर्स और मेटाडेटा से मानकीकृत नैदानिक रिपोर्टों का निर्माण करके डिम्बग्रंथि कैंसर (ओवेरियन कैंसर) के लिए उच्च-निष्ठा वाले, टेक्स्ट-कंडीशन्ड 3D CT स्कैन उत्पन्न करता है, जिससे मूल रेडियोलॉजी रिपोर्ट की आवश्यकता के बिना एब्डोमिनो-पेल्विक ऑन्कोलॉजी में डेटा की कमी और गोपनीयता संबंधी बाधाओं को दूर किया जा सके।

Francesca Pia Panaccione, Eugenio Lomurno, Francesca Fati, Carlotta Pecchiari, Marina Rosanu, Luigi De Vitis, Lucia Ribe (…)2026-06-30
🔬 materials science

On Surrogate Modeling of Static Response of AM Short-Fiber Thermoplastics Using Graph Neural Networks

यह शोध पत्र एक भौतिकी-सूचित (physics-informed), हाइब्रिड ग्राफ न्यूरल नेटवर्क-लॉन्ग शॉर्ट-टर्म मेमोरी (GNN-LSTM) सरोगेट मॉडल प्रस्तावित करता है जो सूक्ष्म संरचनात्मक टोपोलॉजी और क्षति विकास को एनकोड करके एडिटिवली मैन्युफैक्चर्ड शॉर्ट-फाइबर थर्मोप्लास्टिक कंपोजिट के गैर-रेखीय यांत्रिक व्यवहार की सटीक और कुशल भविष्यवाणी करता है, जिससे डिजिटल ट्विन विकास के लिए पारंपरिक परिमित तत्व विश्लेषण (finite element analysis) की कम्प्यूटेशनल सीमाओं पर विजय प्राप्त होती है।

Pharindra Pathak (Auburn University, Oakridge National Lab, NASA Glenn Research Center, Auburn University, Auburn Univer (…)2026-06-30
📈 economics

Liquidity-Based Audit of Algorithmic Trading Strategies

यह शोध पत्र एक नवीन पद्धति प्रस्तुत करता है जिससे केवल व्यापार और मूल्य डेटा का उपयोग करके यह पहचाना जा सकता है कि एल्गोरिद्मिक ट्रेडिंग रणनीतियाँ शुद्ध तरलता उपभोक्ता (net liquidity consumers) के रूप में कार्य करती हैं या प्रदाता (providers) के रूप में, जो अपूर्णता (illiquidity) के एक क्लोज्ड-फॉर्म माप को व्युत्पन्न करता है और यह प्रदर्शित करता है कि कैसे सहसंबद्ध रणनीतियों का एकत्रीकरण कल्याण-घटाने वाले 'फायर-सेल' बाहरी प्रभावों (fire-sale externalities) को उत्पन्न कर सकता है।

Irene Aldridge2026-06-30
💬 NLP

The strength of clinical evidence is recoverable from language model representations but not from their stated grades

यद्यपि लार्ज लैंग्वेज मॉडल्स अपने आंतरिक निरूपण (इंटरनल रिप्रेजेंटेशन) के भीतर नैदानिक साक्ष्य की शक्ति का एक पुनर्प्राप्त करने योग्य संकेत समाहित करते हैं, फिर भी वे इस जानकारी को स्पष्ट रूप से बताने में लगातार विफल रहते हैं, जिससे उनके घोषित साक्ष्य ग्रेड, उस अंतर्निहित संकेत की उपस्थिति के बावजूद, अविश्वसनीय हो जाते हैं।

Soroosh Tayebi Arasteh2026-06-30
🤖 machine learning

How Far Can Sharpness and Complexity Jointly Explain Generalization?

यह शोध पत्र पारेटो-आधारित विश्लेषण और फलन-उन्मुख परिभाषाओं का उपयोग करते हुए, शार्पनेस (sharpness) और कॉम्प्लेक्सिटी (complexity) की डीप न्यूरल नेटवर्क के सामान्यीकरण (generalization) पर संयुक्त व्याख्यात्मक शक्ति की जांच करता है, और यह पाता है कि हालांकि ये दो कारक विविध परिवेशों में समझ को महत्वपूर्ण रूप से बढ़ाते हैं, वे अभी तक सामान्यीकरण का एक पूर्ण सिद्धांत नहीं बनते हैं।

Ziyu Cheng, Xitong Zhang, Longxiu Huang, Rongrong Wang2026-06-30
🤖 machine learning

When Can Conformal Risk Control Certify LLM Outputs? Bounds, Impossibility, and Adaptation for Structured Generation

यह शोध पत्र उच्च-जोखिम वाले परिदृश्यों के लिए एक असंभवता सीमा (impossibility bound) को सिद्ध करके, एडेप्टिव बाउंड्स और डिस्ट्रीब्यूशन शिफ्ट के तहत अनुमान से महत्वपूर्ण लाभ प्रदर्शित करके, और एक ऐसा परिनियोजन ढांचा प्रदान करके जो विभिन्न मॉडलों और कार्यों में प्रमाणन (certification) की उपलब्धि को पहचानता है, स्ट्रक्चर्ड LLM आउटपुट को प्रमाणित करने के लिए कॉन्फॉर्मल रिस्क कंट्रोल की सैद्धांतिक व्यवहार्यता और व्यावहारिक सीमाओं को स्थापित करता है।

Varun Kotte2026-06-30
💬 NLP

A Comparative Study on Affective Cues in Text Embeddings Across Psychological Emotion Theories

यह अध्ययन तीन मनोवैज्ञानिक भावना ढांचों के माध्यम से बारह आधुनिक टेक्स्ट एनकोडर्स का मूल्यांकन करता है, जो यह प्रकट करता है कि जहाँ निर्देश-जागरूक ओपन-वेट मॉडल शब्द-स्तरीय एम्बेडिंग में भावनात्मक जानकारी को पकड़ने में उत्कृष्ट हैं, वहीं टास्क-ट्यून्ड और प्रोप्राइटरी एनकोडर्स वाक्य-स्तरीय भावनात्मक वर्गीकरण में बेहतर प्रदर्शन करते हैं।

Fabio Ciani, Harald Schweiger, Emilia Parada-Cabaleiro, Markus Schedl2026-06-30
🤖 machine learning

Statistically Indistinguishable, Operationally Distinct: A Formal Barrier for Tabular Foundation Models

यह शोध पत्र यह प्रदर्शित करके टैबुलर फाउंडेशन मॉडल्स के लिए एक औपचारिक बाधा स्थापित करता है कि उन्नत तर्क क्षमताओं के बावजूद, वे कानूनी और नियम-उल्लंघन करने वाली डेटाबेस अवस्थाओं के बीच अंतर नहीं कर सकते हैं यदि उनके पास डेटा को नियंत्रित करने वाले परिचालन नियमों तक पहुंच नहीं है, जैसा कि उनके "ऑपरेशनल ट्यूरिंग टेस्ट" को पास करने में विफल होने से प्रमाणित होता है जहाँ केवल नियम-व्युत्पन्न ऑडिट ही पूर्ण सटीकता प्राप्त करते हैं।

Tassilo Klein, Johannes Hoffart2026-06-30
🤖 machine learning

DiLaServe: High SLO Attainment Serving for Diffusion Language Models

DiLaServe डिफ्यूजन लैंग्वेज मॉडल्स के लिए एक क्लस्टर-स्तरीय सर्विंग सिस्टम है जो डेडलाइन-अवेयर शेड्यूलिंग, कॉन्फिडेंस-थ्रेशोल्ड एडजस्टमेंट के माध्यम से एडेप्टिव लोड कंट्रोल और एप्रोक्सिमेट KV कैशिंग से होने वाली स्टेप-लेवल हेटेरोजेनिटीिटी को ध्यान में रखते हुए डायनेमिक क्लस्टर रीकॉन्फ़िगरेशन के माध्यम से न्यूनतम सटीकता हानि के साथ SLO प्राप्ति में 56.6 प्रतिशत अंकों तक सुधार करता है और लेटेंसी को 46% तक कम करता है।

Tzu-Tao Chang, Benjamin Yuanyang Hong, Kiet Pham, Shivaram Venkataraman2026-06-30