🤖 machine learning

AIGP: An LLM-Based Framework for Long-Term Value Alignment in E-Commerce Pricing

यह शोध पत्र AIGP का प्रस्ताव करता है, जो एक LLM-आधारित फ्रेमवर्क है जो व्याख्यात्मक, दीर्घकालिक मूल्य-संरेखित गतिशील मूल्य निर्धारण प्राप्त करने के लिए ऑफलाइन रीइन्फोर्समेंट लर्निंग और डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन के माध्यम से प्रशिक्षित लॉन्ग-टर्म वैल्यू एस्टिमेटर के साथ सुपरवाइज्ड फाइन-ट्यूनिंग को एकीकृत करता है, जो बड़े पैमाने के ई-कॉमर्स A/B परीक्षणों में GMV, ROI और माइलस्टोन उपलब्धि दरों में महत्वपूर्ण सुधार प्रदर्शित करता है।

Chennan Ma, Yanning Zhang, Siqi Hong, Xiuchong Wang, Fei Xiao, Keping Yang2026-06-26
🤖 AI

NaviCache: Test-Time Self-Calibration Caching for Video Generation

NaviCache वीडियो डिफ्यूजन मॉडल्स के लिए एक प्लग-एंड-प्ले टेस्ट-टाइम सेल्फ-कैलिब्रेशन विधि है जो फीचर इवोल्यूशन को इनर्शियल नेविगेशन सिस्टम समस्या के रूप में पुनर्कल्पित करती है ताकि ऑफलाइन कैलिब्रेशन डेटा पर निर्भर रहे बिना एरर-बाउंडेड कंप्यूटेशन स्किपिंग और बेहतर त्वरण प्रदर्शन प्राप्त किया जा सके।

Zheqi Lv, Zhibo Zhu, Jinke Wang, Qi Tian, Shengyu Zhang, Zhengyu Chen, Chengxi Zang, Zhou Zhao, Fei Wu2026-06-26
🤖 AI

The Capability Frontier: Benchmarks Miss 82% of Model Performance

यह शोध पत्र "कैपेबिलिटी फ्रंटियर" (Capability Frontier) को प्रस्तुत करता है, जो एक पारेटो-इष्टतम (Pareto-optimal) मूल्यांकन ढांचा है जो यह प्रकट करता है कि मौजूदा बेंचमार्क व्यवस्थित रूप से वास्तविक दुनिया के एलएलएम (LLM) प्रदर्शन को 82% तक कम करके आंकते हैं क्योंकि वे विविध मॉडलों की पूरक शक्तियों और कई पीढ़ियों (generations) में से सर्वश्रेष्ठ आउटपुट चुनने के लाभों को ध्यान में रखने में विफल रहते हैं।

Bradley Fowler, Ryan Smith, Daniel Thi Graviet, William Myers, Joshua Greaves, Narmeen Fatimah Oozeer, Antía García, Phi (…)2026-06-26
🤖 AI

LCAi: Life Cycle Assessment with big data fusion and retrieval-augmented generation-assisted interpretation

यह शोध पत्र LCAi प्रस्तुत करता है, जो एक परिप्रेक्ष्य-सशर्त रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है जो बहु-स्रोत डेटा और नियंत्रित संश्लेषण को एकीकृत करता है ताकि मतिभ्रम (hallucinations) को कम किया जा सके और अनिश्चितता के तहत जीवन चक्र मूल्यांकन परिणामों को कार्रवाई योग्य रणनीतिक मार्गों में अनुवादित किया जा सके, जैसा कि हाइड्रोजन-सक्षम सेब उत्पादन के केस स्टडी में प्रदर्शित किया गया है।

Georgios Tsironis, Juan D. Medrano-Garcia, Gonzalo Guillen-Gosalbez2026-06-26
🤖 AI

A Pipeline for Generating Longitudinal Synthetic Clinical Notes Using Large Language Models

यह शोध पत्र एक मॉड्यूलर पाइपलाइन और 70 सिंथेटिक अनुदैर्ध्य (लॉन्गीटुडिनल) रोगी रिकॉर्ड का एक संगत डेटासेट प्रस्तुत करता है, जिसमें प्रत्येक रिकॉर्ड में 20-50 नैदानिक नोट्स हैं, जिन्हें आंतरिक निरंतरता और यथार्थवादी भिन्नता सुनिश्चित करते हुए गोपनीयता-संरक्षित नैदानिक एआई उपकरणों के विकास और मूल्यांकन को समर्थन देने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करके तैयार किया गया है।

William Poulett2026-06-26
🤖 AI

Generative Retrieval via Diffusion Transformer with Metric-Ordered Sequence Training and Hybrid-Policy Preference Optimization

यह शोध पत्र MO-DiT+HPPO प्रस्तुत करता है, जो एक जनरेटिव रिट्रीवल फ्रेमवर्क है जो निरंतर एम्बेडिंग स्पेस में पैटर्न संरक्षण और एट्रिब्यूट टारगेटिंग के बीच प्रभावी ढंग से संतुलन बनाने के लिए मेट्रिक-ऑर्डर्ड सीक्वेंस ट्रेनिंग और हाइब्रिड-पॉलिसी प्रेफरेंस ऑप्टिमाइज़ेशन को संयोजित करता है।

Chenghao Liu, Yu Zhang, Zhongtao Jiang, Kun Xu, Zhenwei An, Renzhi Wang, Zhao Wang, Jiachen Zhang, Yuxiao Zhang, Kun Xu (…)2026-06-26
🤖 AI

Confidence-Aware Tool Orchestration for Robust Video Understanding

यह शोध पत्र Robust-TO को प्रस्तुत करता है, जो एक एजेंटिक वीडियो समझ ढांचा (framework) है जो प्रति-फ्रेम विश्वसनीयता स्कोर को एक एकीकृत टूल ऑर्केस्ट्रेशन सिस्टम में एकीकृत करके "ब्लाइंड ट्रस्ट प्रॉब्लम" को कम करता है, जिससे अत्याधुनिक मॉडलों की तुलना में सटीकता और दृश्य भ्रष्टाचार (visual corruptions) के विरुद्ध मजबूती में महत्वपूर्ण सुधार होता है।

Yangfan He, Yujin Choi, Jaehong Yoon2026-06-26
🤖 AI

Chai: Agentic Discovery of Cryptographic Misuse Vulnerabilities

चाय (Chai) एक एआई-आधारित प्रणाली है जो स्वाभाविक रूप से उत्पन्न होने वाले संकेतों का लाभ उठाकर और लाइब्रेरी-स्तर के दोषों को सूचीबद्ध करने तथा उन्हें डिपेंडेंसी ग्राफ्स में प्रसारित करने के लिए पारंपरिक खोज प्रतिमान (डिस्कवरी पैराडाइम) को उलटकर, क्रिप्टोग्राफिक दुरुपयोग कमजोरियों की खोज और सत्यापन करती है, जिससे अंततः व्यापक रूप से उपयोग किए जाने वाले SSL और ब्राउज़र लाइब्रेरीज़ में महत्वपूर्ण कमजोरियों सहित 100 से अधिक सुरक्षा संबंधी मुद्दों का पता चलता है।

Corban Villa, Sohee Kim, Austin Chu, Alon Shakevsky, Raluca Ada Popa2026-06-26
🤖 AI

Scaling Multi-Reference Image Generation with Dynamic Reward Optimization

यह शोध पत्र OmniRef-Bench प्रस्तुत करता है, जो जटिल बहु-संदर्भ (multi-reference) छवि निर्माण में वर्तमान मॉडलों की सीमाओं को उजागर करने वाला एक व्यापक बेंचमार्क है, और DyRef का प्रस्ताव करता है, जो 'डिफिकल्टी-अवेयर एडवांटेज रीवेटिंग' (Difficulty-aware Advantage Reweighting) और 'डिस्क्रिमिनेटिव रिवॉर्ड स्केलिंग' (Discriminative Reward Scaling) का उपयोग करने वाला एक दो-चरणीय प्रशिक्षण ढांचा है जो इन चुनौतीपूर्ण परिदृश्यों में मॉडल के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।

Wenwang Huang, Yusen Fu, Junjie Wang, Mengfei Huang, Yulin Li, Gan Liu, Jing Cai, Yancheng He, Zhuotao Tian2026-06-26
🤖 AI

Einstein World Models

यह शोध पत्र "आइंस्टीन वर्ल्ड मॉडल्स" का प्रस्ताव करता है, जो एक फ्रेमवर्क है जो एक वर्ल्ड-मॉड्यूल द्वारा जनरेट किए गए विजुअल-टेम्पोरल रोलआउट्स को रीजनिंग ट्रेस के भीतर निरीक्षण योग्य परिकल्पनाओं के रूप में एकीकृत करके LLM तर्क क्षमता को बढ़ाता है, जिससे सिस्टम को भाषा-आधारित विश्लेषण के पूरक के रूप में विजुअल थॉट एक्सपेरिमेंट्स (दृश्य विचार प्रयोग) करने में सक्षम बनाया जा सके।

Munachiso Samuel Nwadike, Zangir Iklassov, Ali Mekky, Zayd M. Kawakibi Zuhri, Kentaro Inui2026-06-26✓ Author reviewed