🤖 AI

OrbitForge: Text-to-3D Scene Generation via Reconstruction-Anchored Video Synthesis

ऑर्बिटफोर्ज (Orbit-Forge) एक नवीन एडेप्टर है जो एकल जनित वीडियो को बिना किसी कार्य-विशिष्ट फाइन-ट्यूनिंग या प्रगतिशील दृश्य पीढ़ी की आवश्यकता के, फ्रोजन टेक्स्ट-टू-वीडियो प्रायर्स (priors) और एक इटरेटिव रिकंस्ट्रक्शन-एंकोर्ड ऑप्टिमाइज़ेशन प्रक्रिया का लाभ उठाकर सुसंगत, पूर्ण-ऑर्बिट 3D गॉसियन स्प्लेटिंग दृश्यों में परिवर्तित करता है।

Chenrui Fan, Paolo Favaro2026-06-24
⚛️ quantum physics

Large-Language-Model Discovery of Quantum LDPC Codes through Structured Concept Evolution

यह शोध पत्र स्ट्रक्चर्ड कॉन्सेप्ट इवोल्यूशन (SCE) प्रस्तुत करता है, जो एक ऐसा खोज ढांचा है जो क्वांटम लो-डेंसिटी पैरिटी-चेक (qLDPC) कोड के विविध और प्रतिस्पर्धी परिवारों को स्वचालित रूप से खोजने के लिए लार्ज लैंग्वेज मॉडल्स को बीजगणितीय उत्परिवर्तन व्याकरणों (algebraic mutation grammars) के साथ जोड़ता है, जिसमें गैर-आबेली समूहों (non-abelian groups) पर नवीन निर्माण भी शामिल हैं।

Zidu Liu, Florian Marquardt2026-06-24
🤖 AI

Solving Inverse Problems of Chaotic Systems with Bidirectional Conditional Flow Matching

यह शोध पत्र बाइडायरेक्शनल कंडिशनल फ्लो मैचिंग (Bi-CFM) और इसके संरक्षण-प्रतिबंधित संस्करण (CBi-CFM) को पेश करता है ताकि अराजक प्रणालियों (chaotic systems) में व्युत्क्रम समस्याओं (inverse problems) को प्रभावी ढंग से हल किया जा सके, जो स्टोकेस्टिक विकास को कैप्चर करने वाले द्विदिश मैपिंग (bidirectional mappings) को सीखकर, भौतिक नियमों का सम्मान करते हुए, कम-आयामी मॉडलों से लेकर वास्तविक दुनिया के मिलियन-बॉडी ग्लोबुलर क्लस्टर्स तक विविध गतिशील प्रणालियों में महत्वपूर्ण सटीकता और गति में सुधार प्राप्त करते हैं।

Peiyan Hu, Jian Zhang, Jiashu Pan, Ruiqi Feng, Tao Zhang, Zhi-Ming Ma, Yuan-Sen Ting, Gongjie Li, Tailin Wu2026-06-24
🤖 AI

Difference-Making without Making a Difference

यह शोध पत्र तर्क देता है कि एंड्रियास और गुन्थर की वास्तविक कार्य-कारणता (actual causation) की नवीनतम परिभाषा उनके द्वारा प्रस्तावित तथ्यात्मक, प्रति-तथ्यात्मक (counterfactual) और नियम-आधारित विवरणों के बीच के अंतर को समाप्त कर देती है, और आगे यह प्रदर्शित करता है कि उनके सातों परिभाषाएँ महत्वपूर्ण उदाहरणों पर लागू होने पर विफल हो जाती हैं।

Sander Beckers2026-06-24
📊 statistics

Grading the Grader: Lessons from Evaluating an Agentic Data Analysis System

यह शोध पत्र एक तीन-स्तरीय मानव-एआई कैस्केड और पुनरावृत्ति नजिंग (iterative nudging) रणनीतियों को पेश करके एजेंटिक डेटा विश्लेषण प्रणालियों के लिए स्वचालित ग्रेडिंग की विश्वसनीयता का मूल्यांकन करता है, जो उच्च परिशुद्धता (precision) और रिकॉल (recall) प्राप्त करते हुए वास्तविक आउटपुट असहमति को ग्रेडिंग आर्टिफैक्ट्स से अलग करते हैं।

Tian Zheng, Kai-Tai Hsu2026-06-24
🤖 AI

IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation

यह शोध पत्र IV-CoT का प्रस्ताव करता है, जो एक लेटेंट विजुअल रीजनिंग फ्रेमवर्क है जो केवल प्रशिक्षण-आधारित स्केच पर्यवेक्षण द्वारा निर्देशित एक स्ट्रक्चरल-टू-सेमेंटिक कैस्केड के माध्यम से संरचनात्मक योजना (structural planning) को उपस्थिति रेंडरिंग (appearance rendering) से अलग करके, एकल फॉरवर्ड पास के भीतर, स्ट्रक्चर-अवेयर टेक्स्ट-टू-इमेज जनरेशन में सुधार करता है।

Zixuan Li, Haokun Lin, Yicheng Xiao, Zhiwei Li, Xinyang Song, Zelong Zheng, Yong He, Heng Yao, Ke Ding, Chao Yu, Chuan Y (…)2026-06-24
🤖 AI

It's Complicated: On the Design and Evaluation of AI-Powered AAC Interfaces

यह शोध पत्र छह समस्या क्षेत्रों में ऑग्मेंटेटिव एंड अल्टरनेटिव कम्युनिकेशन (AAC) प्रणालियों में एआई (AI) को एकीकृत करने की जटिलताओं का परीक्षण करता है, और अधिक सुदृढ़, प्रतिच्छेदी मूल्यांकन विधियों के पक्ष में तर्क देता है जो वर्तमान मेट्रिक्स से परे उपयोगकर्ताओं की सूक्ष्म इच्छाओं को समाहित कर सकें।

Blade Frisch, Will Wade, Dylan Gaines, Michelle Kinsella, Betts Peters, Tamara Broderick, Keith Vertanen2026-06-24
🤖 AI

FLUX3D: High-Fidelity 3D Gaussian Generation with Diffusion-Aligned Sparse Representation

FLUX3D एक स्केलेबल इमेज-टू-3D गॉसियन स्प्लेटिंग फ्रेमवर्क है जो डिफ्यूजन-अलाइन्ड स्ट्रक्चर्ड लेटेंट्स (DA-SLAT) और एक स्पार्स-स्ट्रक्चर-अवेयर डिफ्यूजन ट्रांसफार्मर (SMDiT) को पेश करके उच्च-निष्ठा वाले 3D जनरेशन में संरचनात्मक बाधाओं को दूर करता है ताकि प्रतिनिधित्व शिक्षण (representation learning) को बढ़ाया जा सके और सटीक 2D-3D संरेखण प्राप्त किया जा सके।

Haorui Ji, Weizhe Liu, Hongdong Li, Hengkai Guo2026-06-24
🤖 machine learning

InSight: Self-Guided Skill Acquisition via Steerable VLAs

InSight एक ऐसा फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन (VLA) मॉडल्स को प्रदर्शनों (demonstrations) को स्टीयरेबल प्रिमिटिव एक्शन्स में विभाजित करके और नवीन, लॉन्ग-होराइजन कार्यों के लिए नए प्रिमिटिव्स को उत्पन्न करने, लेबल करने और एकीकृत करने हेतु VLM-गाइडेड डेटा फ्लाईव्हील का उपयोग करके, स्वायत्त रूप से नई मैनिपुलेशन स्किल्स प्राप्त करने में सक्षम बनाता है, जिसमें आगे किसी मानवीय हस्तक्षेप की आवश्यकता नहीं होती है।

Maggie Wang, Lars Osterberg, Stephen Tian, Ola Shorinwa, Jiajun Wu, Mac Schwager2026-06-24
⚡ electrical engineering

Explanations for Automatic Speech Recognition

यह शोध पत्र मौजूदा व्याख्यात्मक एआई (Explainable AI) तकनीकों, विशेष रूप से सांख्यिकीय दोष स्थानीयकरण (Statistical Fault Localization) और कारण संबंधी (Causal) विधियों को अनुकूलित करके, न्यूरल नेटवर्क-आधारित स्वचालित वाक् पहचान (Automatic Speech Recognition) में गुणवत्ता मूल्यांकन की चुनौती का समाधान करता है, ताकि ट्रांसक्रिप्शन के लिए न्यूनतम और पर्याप्त ऑडियो फ्रेम स्पष्टीकरण उत्पन्न किए जा सकें, जिससे सिस्टम की समझ और विश्वास में वृद्धि हो सके।

Xiaoliang Wu, Peter Bell, Ajitha Rajan2026-06-23