🤖 machine learning

Wan-Streamer v0.2: Higher Resolution, Same Latency

Wan-Streamer v0.2 एक एंड-टू-एंड ऑडियो-विजुअल इंटरेक्शन मॉडल का लेटेंसी-प्रिजर्विंग अपग्रेड है जो एक स्प्लिट आर्किटेक्चर का उपयोग करके आउटपुट रेजोल्यूशन को 192x336 से दोगुना कर 640x368 कर देता है, जहाँ एक सिंगल-जीपीयू "थिंकर" धारणा और भाषा की स्थिति को संभालता है जबकि एक मल्टी-जीपीयू "परफ़ॉर्मर" समूह हाई-रेजोल्यूशन वीडियो जनरेशन को समानांतर (पैरेललाइज) करता है, जिससे लगभग 550 ms की एंड-टू-एंड लेटेंसी बनी रहती है।

Lianghua Huang, Zhi-Fan Wu, Yupeng Shi, Wei Wang, Mengyang Feng, Junjie He, Chen-Wei Xie, Yu Liu, Jingren Zhou, Ang Wang (…)2026-07-08
🤖 machine learning

TACTIC-KG: Toward Small Agent Teams for Cyber Threat Intelligence Knowledge Graph Construction

TACTIC-KG एक लागत प्रभावी एजेंटिक फ्रेमवर्क है जो अनस्ट्रक्चर्ड थ्रेट रिपोर्ट्स से साइबर सुरक्षा नॉलेज ग्राफ का निर्माण करने के लिए कार्य को हल्के वजन वाले LLMs के लिए विशिष्ट भूमिकाओं में विभाजित करता है, जिससे यह सटीकता, स्थिरता और दक्षता में मोनोलिथिक बड़े मॉडलों से बेहतर प्रदर्शन करता है।

Mouhamed Amine Bouchiha, Gregory Blanc2026-07-08
🤖 AI

KVpop -- Key-Value Cache Compression with Predictive Online Pruning

KVpop एक सीखे हुए, भविष्य कहने वाले ऑनलाइन प्रूनिंग पॉलिसी को पेश करके ऑटोरेग्रेसिव डिकोडिंग में मेमोरी बॉटलनेक को संबोधित करता है जो उच्च संपीड़न दर प्राप्त करने के लिए एक नवीन फ्यूचर-अटेंशन टारगेट और डिलेड स्कोरिंग का उपयोग करता है और गणितीय तर्क कार्यों पर लगभग पूर्ण अटेंशन प्रदर्शन बनाए रखता है।

Lukas Hauzenberger, Niklas Schmidinger, Anamaria-Roberta Hartl, David Stap, Thomas Schmied, Sebastian Böck, Günter Klamb (…)2026-07-08
⚡ electrical engineering

Unified Audio Intelligence Without Regressing on Text Intelligence

यह शोधपत्र Audex को प्रस्तुत करता है, जो एक सुदृढ़ टेक्स्ट-ओनली MoE बैकबोन पर निर्मित एक एकीकृत 30B ऑडियो-टेक्स्ट LLM है, जो मूल मॉडल की उन्नत तर्क क्षमता और एजेंटिक क्षमताओं में बिना किसी महत्वपूर्ण गिरावट के, विविध ऑडियो और स्पीच कार्यों में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Zhifeng Kong, Sang-gil Lee, Jaehyeon Kim, Boxin Wang, Zihan Liu, Sungwon Kim, Yang Chen, Arushi Goel, Rajarshi Roy, Wenl (…)2026-07-08
🤖 machine learning

Shape Over Intensity: Directional Topological Encoding for False Positive Reduction in Intracranial Aneurysm Detection

यह शोध पत्र स्मूथ यूलर कैरेक्टरिस्टिक ट्रांसफॉर्म (SECT) का उपयोग करने वाले एक प्लग-एंड-प्ले फ्रेमवर्क को प्रस्तुत करता है जो तीव्रता से स्वतंत्र रूप से वैश्विक 3D संवहनी ज्यामिति (वैस्कुलर ज्योमेट्री) को एनकोड करके इंट्राक्रेनियल एन्यूरिज्म डिटेक्शन में फॉल्स पॉजिटिव्स को काफी कम करता है, जिससे यह पारंपरिक पर्सिस्टेंस-आधारित विधियों की तुलना में, विशेष रूप से 3 मिमी से कम के छोटे घावों और विभिन्न स्कैनर निर्माताओं के लिए बेहतर प्रदर्शन करता है।

Akshay Gokhale, Mansi Dhamne2026-07-08✓ Author reviewed
💬 NLP

LLM-as-a-Verifier: A General-Purpose Verification Framework

यह शोध पत्र "LLM-as-a-Verifier" प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त ढांचा है जो टोकन लॉजिट अपेक्षाओं (token logit expectations) के माध्यम से निरंतर स्कोरिंग का लाभ उठाकर सत्यापन को एक नए स्केलिंग अक्ष (scaling axis) के रूप में स्थापित करता है, जिससे विविध एजेंटिक बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है और बेहतर कार्य निगरानी एवं सुदृढीकरण शिक्षण (reinforcement learning) नमूना दक्षता सक्षम होती है।

Jacky Kwok, Shulu Li, Pranav Atreya, Yuejiang Liu, Yixing Jiang, Chelsea Finn, Marco Pavone, Ion Stoica, Azalia Mirhosei (…)2026-07-08
💬 NLP

Benchmarking KV-Cache Optimizations across Task Quality and System Performance for Long-Context Serving

यह शोध पत्र विविध मॉडलों और कार्यों में KV-कैश अनुकूलन तकनीकों (KIVI, TurboQuant, SnapKV और CaM सहित) का एक व्यापक वर्कलोड-जागरूक बेंचमार्क प्रस्तुत करता है, जो यह प्रकट करता है कि केवल संपीड़न अनुपात (compression ratio) एंड-टू-एंड प्रदर्शन का एक खराब भविष्यवक्ता है और यह प्रदर्शित करता है कि इष्टतम तंत्र चयन विशिष्ट वर्कलोड आवश्यकताओं पर बहुत अधिक निर्भर करता है।

Nikita Agrawal, Ruben Mayer2026-07-08
💻 computer science

The Jagged Global Economy: Frontier AI Unevenly Exposes National Economies

यह शोध पत्र 141 देशों के लिए एक राष्ट्रीय एआई (AI) एक्सपोजर मीट्रिक प्रस्तुत करता है, जो यह प्रकट करता है कि निम्न-आय वाले देशों और पुरुषों की तुलना में उच्च-आय वाले राष्ट्रों और महिलाओं को फ्रंटियर एआई (frontier AI) से काफी अधिक प्रत्यक्ष जोखिम का सामना करना पड़ता है, जबकि यह प्रेषण (remittances) जैसे देशों के बीच आय निर्भरता के माध्यम से एक महत्वपूर्ण अप्रत्यक्ष जोखिम तंत्र को भी उजागर करता है जिसके लिए अनुकूलित, गैर-सामान्य नीतिगत प्रतिक्रियाओं की आवश्यकता है।

Arul Murugan, Tomás Aguirre, Abhishek Nagaraj, Rishi Bommasani2026-07-08
💻 computer science

CCBENCH: Assessing LLM Cultural Competence via Implicitly Signaled Norms using Health Queries

यह शोध पत्र CCBENCH को पेश करता है, जो विविध व्यक्तित्वों के साथ स्वास्थ्य संबंधी संवादों के माध्यम से बड़े भाषा मॉडलों की सांस्कृतिक सक्षमता का मूल्यांकन करने के लिए एक ढांचा है, जो यह प्रकट करता है कि वर्तमान मॉडल स्पष्ट रूप से संकेतित सांस्कृतिक मानदंडों के अनुकूल होने में संघर्ष करते हैं और अक्सर अंतर्निहित पूर्वाग्रहों पर निर्भर रहते हैं, जिससे वे केवल 20-30% मामलों में ही सांस्कृतिक रूप से उपयुक्त प्रतिक्रियाएं प्राप्त कर पाते हैं।

Vasudha Varadarajan, Akhila Yerukola, Mona T. Diab, Maarten Sap2026-07-08
💻 computer science

A Guiding Framework for K-12 Teachers in Creating AI-powered Learning Technologies through Vibe Coding

यह शोध पत्र GAIDE को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो K-12 शिक्षकों को "वाइब कोडिंग" के माध्यम से AI-संचालित शिक्षण उपकरण डिजाइन करने में सक्षम बनाता है, एक ऐसी प्रक्रिया जिसे आठ सप्ताह की कार्यशाला द्वारा प्रमाणित किया गया है जिसने 'लर्निंग-बाय-क्रिएटिंग' के माध्यम से शिक्षकों की AI साक्षरता और व्यावसायिक विकास में महत्वपूर्ण सुधार प्रदर्शित किया है।

Yukyeong Song, Seoyeon Choi, Jinhee Kim, Yeongje Kim, Lauren Weisberg, Jewoong Moon2026-07-08