🤖 AI

IB-Flow: Information Bottleneck-Guided CFG Distillation for Few-Step Text-to-Image Generation

IB-Flow एक नवीन फ्यू-स्टेप टेक्स्ट-टू-इमेज जनरेशन फ्रेमवर्क है जो स्टैटिक, ब्लाइंड क्लासिफायर-फ्री गाइडेंस डिस्टिलेशन को इंस्टेंस-अवेयर टारगेट सिलेक्शन और एंट्रॉपी-अवेयर स्ट्रेंथ शेड्यूलिंग वाले ड्यूल-ट्रैक अडैप्टिव मैकेनिज्म से बदलने के लिए इंफॉर्मेशन बॉटलनेक सिद्धांत का लाभ उठाता है, जिससे ओवर-कंडीशनिंग आर्टिफैक्ट्स समाप्त हो जाते हैं और केवल दो स्टेप्स में स्टेट-ऑफ-द-आर्ट फिडेलिटी प्राप्त होती है।

Yiting Wang, Jingyi Zhang, Wenhu Zhang, Ke Chao, Yves Liang, Kun Cheng, Kang Zhao2026-07-13
🤖 AI

KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling

KV-PRM एक कुशल प्रोसेस रिवॉर्ड मॉडल है जो टेक्स्ट-आधारित री-एनकोडिंग की कम्प्यूटेशनल बाधा को समाप्त करने के लिए सीधे प्री-कंप्यूटेड KV कैश का लाभ उठाता है ताकि स्कोरिंग जटिलता को O(L²) से घटाकर O(L) किया जा सके, जिससे कई रीजनिंग बेंचमार्क में मौजूदा तरीकों के बराबर या उनसे बेहतर प्रदर्शन करते हुए गति और मेमोरी में भारी लाभ प्राप्त होता है।

Peng Kuang, Haibo Jin, Xiaoyu Han, Yanli Wang, Xiaopeng Yuan, Ye Yu, Kaidi Xu, Haohan Wang2026-07-13
🤖 AI

Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distribution Shift

यह शोध पत्र ग्राफ-रेगुलराइज्ड एजेंटिक कॉन्टेक्स्ट इवोल्यूशन (GRACE) प्रस्तुत करता है, जो अपडेट के स्थानीय सत्यापन को सक्षम करने के लिए निरंतर सिस्टम निर्देशों को टाइप किए गए सिमेंटिक ग्राफ के रूप में संरचित करता है, जिससे फ्लैट-टेक्स्ट बेसलाइन की तुलना में डिस्ट्रीब्यूशन शिफ्ट के तहत एलएलएम (LLM) एजेंटों की लॉन्ग-होरिज़न विश्वसनीयता में महत्वपूर्ण सुधार होता है।

Dan C. Hsu, Luke Lu2026-07-13
🔢 mathematics

Generative Communications: Overview, Technologies, and Trends

यह शोध पत्र जेनेरेटिव कम्युनिकेशंस (GenCom) को एक नए 6G प्रतिमान (paradigm) के रूप में प्रस्तुत करता है जहाँ बड़े AI मॉडल अर्थ संबंधी समझ और सामग्री निर्माण को संचालित करते हैं, जो संचार को बिट-दर-बिट ट्रांसमिशन के बजाय नियंत्रित संश्लेषण (controlled synthesis) के रूप में पुनर्परिभाषित करते हैं ताकि अत्यंत कुशल, सुदृढ़ और बुद्धिमान नेटवर्किंग प्राप्त की जा सके।

Wenjun Zhang, Zhiyong Chen, Tong Wu, Guo Lu, Li Song, Feng Yang, Meixia Tao2026-07-13
🔬 materials science

Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents

यह शोध पत्र हाइपोथीसिस इवोल्यूशन प्रोटोकॉल (HEP) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो लार्ज लैंग्वेज मॉडल एजेंटों को परिकल्पना सृजन, परीक्षण और विश्वास संशोधन के लिए स्पष्ट, ऑडिट योग्य संचालन से सुसज्जित करता है, जिससे पारदर्शी और सत्यापन योग्य एआई-संचालित वैज्ञानिक खोज सक्षम होती है।

Izumi Takahara, Teruyasu Mizoguchi2026-07-13
🤖 machine learning

Interference and Retention in Continual Learning

यह शोध पत्र इंटरफेरेंस-गेटेड फंक्शनल एलोकेशन (IGFA) प्रस्तावित करता है, जो एक रिप्ले-फ्री कॉन्टिनुअल लर्निंग पद्धति है जो विस्मरण (forgetting) को टास्क इंटरफेरेंस एनर्जी के रूप में मॉडल करती है ताकि विभाज्य कार्यों के लिए इसे संरचनात्मक रूप से समाप्त किया जा सके और संघर्षरत कार्यों के लिए रिटेंशन और प्लास्टिसिटी के बीच इष्टतम संतुलन बनाया जा सके।

Julius Störk2026-07-13
🤖 AI

LLMs for health: Perceived benefits, risks, intention to use AI chatbots, and willingness to self-disclose across sensitive health topics

1,388 डच प्रतिभागियों के एक अध्ययन के आधार पर, यह शोध पत्र पाता है कि स्वास्थ्य संबंधी पूछताछ के लिए एआई चैटबॉट्स का उपयोग करने का इरादा और संवेदनशील जानकारी को स्वयं प्रकट करने की इच्छा मुख्य रूप से कथित लाभों, कथित जोखिमों और व्यक्तिगत विशेषताओं द्वारा संचालित होती है, न कि चर्चा किए गए स्वास्थ्य विषय के विशिष्ट प्रकार या संवेदनशीलता द्वारा।

Gwenn Beets, Anniek Jansen, Saar Hommes, Ruben D. Vromans, Leonie Westerbeek, Supraja Sankaran, Julia C. M. van Weert, E (…)2026-07-13
🤖 AI

Geopolitical alignment: Endorsement effects in large language models

यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) नीतिगत मूल्यांकनों में महत्वपूर्ण भू-राजनीतिक पूर्वाग्रह प्रदर्शित करते हैं, जहाँ वे समान नीतियों को अमेरिका या यूरोपीय संघ की तुलना में चीन या रूस द्वारा समर्थित होने पर व्यवस्थित रूप से कम रेटिंग देते हैं, और ये विसंगतियाँ मॉडल के आधार पर तथा यह निर्भर करते हुए बनी रहती हैं या तीव्र हो जाती हैं कि औचित्य माँगा गया है या नहीं।

Maxim Chupilkin2026-07-13
💬 NLP

Creativity, honesty and designed forgetting emerge in small hyperbolic language models

यह शोध पत्र प्रदर्शित करता है कि हाइपरबोलिक सबस्ट्रेट (hyperbolic substrate) से सुसज्जित तीन लघु भाषा मॉडल अनुपालन अंतराल (compliance gaps) और चापलूसी (sycophancy) का पता लगाकर, रचनात्मक प्रतिक्रियाएं उत्पन्न करके, और एक "डिज़ाइन किया गया विस्मरण" (designed forgetting) तंत्र को लागू करके, भरोसेमंद साथी एआई (companion AI) की चुनौतियों को प्रभावी ढंग से संबोधित कर सकते हैं, जिससे अविश्वसनीय मानव रेटर्स और बड़े फ्रंटियर मॉडलों के एक स्केलेबल विकल्प के रूप में प्रस्ताव मिलता है।

Kwan Soo Shin, In Seok Kang, Yunkyung Min2026-07-13
🤖 machine learning

Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

यह शोध पत्र शॉर्टकट ट्रजेक्टरी प्लानिंग (STP) का प्रस्ताव करता है, जो एक सिंगल-स्टेज ऑफलाइन रीइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो विविध बेंचमार्क पर मजबूत प्रदर्शन बनाए रखते हुए कम प्रशिक्षण और अनुमान लागत के साथ कुशल, एडजस्टेबल-स्टेप ट्रजेक्टरी जनरेशन को सक्षम करने के लिए कंडीशनल शॉर्टकट मॉडल्स का उपयोग करता है।

Guanquan Wang, Yoshimasa Tsuruoka2026-07-13