🤖 AI

A Pipeline for Generating Longitudinal Synthetic Clinical Notes Using Large Language Models

यह शोध पत्र एक मॉड्यूलर पाइपलाइन और 70 सिंथेटिक अनुदैर्ध्य (लॉन्गीटुडिनल) रोगी रिकॉर्ड का एक संगत डेटासेट प्रस्तुत करता है, जिसमें प्रत्येक रिकॉर्ड में 20-50 नैदानिक नोट्स हैं, जिन्हें आंतरिक निरंतरता और यथार्थवादी भिन्नता सुनिश्चित करते हुए गोपनीयता-संरक्षित नैदानिक एआई उपकरणों के विकास और मूल्यांकन को समर्थन देने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करके तैयार किया गया है।

William Poulett2026-06-26
🤖 AI

Generative Retrieval via Diffusion Transformer with Metric-Ordered Sequence Training and Hybrid-Policy Preference Optimization

यह शोध पत्र MO-DiT+HPPO प्रस्तुत करता है, जो एक जनरेटिव रिट्रीवल फ्रेमवर्क है जो निरंतर एम्बेडिंग स्पेस में पैटर्न संरक्षण और एट्रिब्यूट टारगेटिंग के बीच प्रभावी ढंग से संतुलन बनाने के लिए मेट्रिक-ऑर्डर्ड सीक्वेंस ट्रेनिंग और हाइब्रिड-पॉलिसी प्रेफरेंस ऑप्टिमाइज़ेशन को संयोजित करता है।

Chenghao Liu, Yu Zhang, Zhongtao Jiang, Kun Xu, Zhenwei An, Renzhi Wang, Zhao Wang, Jiachen Zhang, Yuxiao Zhang, Kun Xu (…)2026-06-26
🤖 AI

Confidence-Aware Tool Orchestration for Robust Video Understanding

यह शोध पत्र Robust-TO को प्रस्तुत करता है, जो एक एजेंटिक वीडियो समझ ढांचा (framework) है जो प्रति-फ्रेम विश्वसनीयता स्कोर को एक एकीकृत टूल ऑर्केस्ट्रेशन सिस्टम में एकीकृत करके "ब्लाइंड ट्रस्ट प्रॉब्लम" को कम करता है, जिससे अत्याधुनिक मॉडलों की तुलना में सटीकता और दृश्य भ्रष्टाचार (visual corruptions) के विरुद्ध मजबूती में महत्वपूर्ण सुधार होता है।

Yangfan He, Yujin Choi, Jaehong Yoon2026-06-26
🤖 AI

Chai: Agentic Discovery of Cryptographic Misuse Vulnerabilities

चाय (Chai) एक एआई-आधारित प्रणाली है जो स्वाभाविक रूप से उत्पन्न होने वाले संकेतों का लाभ उठाकर और लाइब्रेरी-स्तर के दोषों को सूचीबद्ध करने तथा उन्हें डिपेंडेंसी ग्राफ्स में प्रसारित करने के लिए पारंपरिक खोज प्रतिमान (डिस्कवरी पैराडाइम) को उलटकर, क्रिप्टोग्राफिक दुरुपयोग कमजोरियों की खोज और सत्यापन करती है, जिससे अंततः व्यापक रूप से उपयोग किए जाने वाले SSL और ब्राउज़र लाइब्रेरीज़ में महत्वपूर्ण कमजोरियों सहित 100 से अधिक सुरक्षा संबंधी मुद्दों का पता चलता है।

Corban Villa, Sohee Kim, Austin Chu, Alon Shakevsky, Raluca Ada Popa2026-06-26
🤖 AI

Scaling Multi-Reference Image Generation with Dynamic Reward Optimization

यह शोध पत्र OmniRef-Bench प्रस्तुत करता है, जो जटिल बहु-संदर्भ (multi-reference) छवि निर्माण में वर्तमान मॉडलों की सीमाओं को उजागर करने वाला एक व्यापक बेंचमार्क है, और DyRef का प्रस्ताव करता है, जो 'डिफिकल्टी-अवेयर एडवांटेज रीवेटिंग' (Difficulty-aware Advantage Reweighting) और 'डिस्क्रिमिनेटिव रिवॉर्ड स्केलिंग' (Discriminative Reward Scaling) का उपयोग करने वाला एक दो-चरणीय प्रशिक्षण ढांचा है जो इन चुनौतीपूर्ण परिदृश्यों में मॉडल के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।

Wenwang Huang, Yusen Fu, Junjie Wang, Mengfei Huang, Yulin Li, Gan Liu, Jing Cai, Yancheng He, Zhuotao Tian2026-06-26
🤖 AI

Einstein World Models

यह शोध पत्र "आइंस्टीन वर्ल्ड मॉडल्स" का प्रस्ताव करता है, जो एक फ्रेमवर्क है जो एक वर्ल्ड-मॉड्यूल द्वारा जनरेट किए गए विजुअल-टेम्पोरल रोलआउट्स को रीजनिंग ट्रेस के भीतर निरीक्षण योग्य परिकल्पनाओं के रूप में एकीकृत करके LLM तर्क क्षमता को बढ़ाता है, जिससे सिस्टम को भाषा-आधारित विश्लेषण के पूरक के रूप में विजुअल थॉट एक्सपेरिमेंट्स (दृश्य विचार प्रयोग) करने में सक्षम बनाया जा सके।

Munachiso Samuel Nwadike, Zangir Iklassov, Ali Mekky, Zayd M. Kawakibi Zuhri, Kentaro Inui2026-06-26✓ Author reviewed
🤖 AI

In-Context Model Predictive Generation: Open-Vocabulary Motion Synthesis from Language Models to Physics

यह शोध पत्र इन-कॉन्टेक्स्ट मॉडल प्रिडिक्टिव जनरेशन (ICMPG) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो लार्ज लैंग्वेज मॉडल प्लानिंग को क्लोज्ड-लूप, मॉडल प्रिडिक्टिव कंट्रोल-जैसे प्रोसेस में इन्फरेंस-टाइम फिजिकल फीडबैक के साथ एकीकृत करके टेक्स्ट-ड्रिवन मोशन सिंथेसिस में सिमेंटिक फिडेलिटी और फिजिकल रियलिज्म के बीच के अंतर को पाटता है।

Xiaomeng Fu, Junfan Lin, Yang Liu, Yaowei Wang, Guanbin Li, Liang Lin, Ziliang Chen2026-06-26
💬 NLP

Auditing Framing-Sensitive Behavioral Instability in Large Language Models for Mental Health Interactions

यह शोध पत्र इस बात की जांच करता है कि कैसे प्रासंगिक फ्रेमिंग (contextual framing) मानसिक स्वास्थ्य संबंधी बातचीत में बड़े भाषा मॉडलों (large language models) की व्यवहारिक स्थिरता और आंतरिक निरूपणों को प्रभावित करती है, जो यह प्रकट करता है कि फ्रेमिंग व्यवस्थित रूप से प्रतिक्रिया प्रवृत्तियों को बदल देती है और ये प्रभाव मॉडलों की आंतरिक परतों के भीतर डिकोड करने योग्य और आंशिक रूप से परिवर्तनीय हैं।

Abla Bedoui, Ashley L. Greene, Mohammed Cherkaoui2026-06-26
💬 NLP

ReaORE: Reasoning-Guided Progressive Open Relation Extraction Empowered by Large Reasoning Models

ReaORE एक नवीन ढांचा है जो बड़े रीजनिंग मॉडलों का लाभ उठाकर ओपन रिलेशन एक्सट्रैक्शन को बढ़ाता है ताकि कोर्स-टू-फाइन (coarse-to-fine) रिलेशन रीजनिंग की जा सके, जो संबंध फ़िल्टरिंग और सूक्ष्म-स्तरीय भविष्यवाणी की दो-चरणीय प्रक्रिया के माध्यम से सामान्यीकरण और भेदभाव की चुनौतियों को प्रभावी ढंग से संबोधित करता है।

Xin Lin, Liang Zhang, Guoqi Ma, Hongyao Tu, Jinsong Su2026-06-26
💬 NLP

Where Do Models Find Happiness? Emotion Vectors in Open-Source LLMs

यह शोध पत्र प्रदर्शित करता है कि ओपन-सोर्स LLMs (Apertus-8B और Gemma-4), प्रोप्रायटरी मॉडल्स के तुलनीय वैलेंस ज्योमेट्री (valence geometry) के साथ भावना अवधारणाओं को एनकोड करते हैं, जबकि यह भी दर्शाता है कि ये प्रतिनिधित्व मॉडल की गहराई में कैसे उभरते हैं और निष्कर्षण कॉर्पस (extraction corpus) के आधार पर कैसे भिन्न होते हैं, जिसमें विशिष्ट, आर्किटेक्चर-विशिष्ट पैटर्न प्रकट होते हैं।

Sinie van der Ben, Raphaël Baur, Yannick Metz, Mennatallah El-Assady2026-06-26