🤖 machine learning

Geometric Flow Matching for Molecular Conformation Generation via Manifold Decomposition

यह शोध पत्र GO-Flow का प्रस्ताव करता है, जो एक ज्यामितिक फ्लो मैचिंग मॉडल है जो आणविक विन्यास (molecular conformation) के निर्माण को अनुवाद (translation), घूर्णन (rotation) और विन्यास उपस्थानों (conformation subspaces) में विभाजित करता है ताकि इसे अंतर्निहित भौतिक बाधाओं के अनुरूप बनाया जा सके, जिससे काफी कम चरणों में अत्याधुनिक सटीकता और उच्च-सटीकता वाला नमूनाकरण (high-fidelity sampling) प्राप्त किया जा सके।

Yunqing Liu, Yi Zhou, Wenqi Fan2026-05-26
🤖 machine learning

Extreme Region Policy Distillation

एक्स्ट्रीम रीजन पॉलिसी डिस्टिलेशन (ERPD), एलएलएम (LLMs) के लिए आरएल (RL) में सैंपल एफिशिएंसी और एसिम्प्टोटिक परफॉरमेंस के बीच के ट्रेड-ऑफ को एग्रेसिव ऑफ-पॉलिसी ऑप्टिमाइजेशन को कंजर्वेटिव ट्रस्ट-रीजन कंस्ट्रेंट्स से अलग करके संबोधित करता है, जो पहले फिक्स्ड डेटा से मैक्सिमल ट्रेनिंग सिग्नल्स निकालता है और फिर उन्हें एक बेस पॉलिसी में डिस्टिल करता है ताकि काफी कम केएल (KL) डाइवर्जेंस के साथ बेहतर प्रदर्शन प्राप्त किया जा सके।

Changyu Chen, Xiting Wang, Rui Yan2026-05-26
🤖 AI

Acting on the Unseen: Communication-Free Collaborative Filtering for Decentralized Multi-Robot Task Allocation

यह शोध पत्र ज़ीरो-नॉलेज मल्टी-रोबोट टास्क एलोकेशन (ZK-MRTA) प्रस्तुत करता है, जो एक संचार-रहित ढांचा है जहाँ रोबोट किसी भी पूर्व कार्य मॉडल या रोबोटों के बीच संदेश-विनिमय के बिना, एक छिपे हुए लो-रैंक स्ट्रक्चर का लाभ उठाते हैं और ऑनलाइन सहयोगी फ़िल्टरिंग करने के लिए अपने साथी रोबोटों के परिणामों को प्रसारित करते हैं, जिससे प्रमाणित रूप से इष्टतम सैंपल कॉम्प्लेक्सिटी और लगभग केंद्रीकृत प्रदर्शन प्राप्त होता है।

Alexander Apartsin, Yigal Meshulam, Yehudit Aperstein2026-05-26
💬 NLP

Toward a Benchmark for Controllable Simulation of Imperfect Students with Large Language Models

यह शोध पत्र शिक्षक शिक्षा में सहायता के लिए नियंत्रणीय, आंशिक कौशल महारत वाले छात्रों का अनुकरण करने हेतु बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) का उपयोग करने के लिए एक बेंचमार्क-उन्मुख ढांचे को प्रस्तुत करता है, यह प्रदर्शित करते हुए कि हालांकि दक्षताओं का चयनात्मक प्रतिधारण और दमन प्राप्त करने योग्य है, नियंत्रण की डिग्री उपयोग किए गए विशिष्ट मॉडल पर निर्भर करती है।

Alexander Apartsin, Omri Sason, Yehudit Aperstein2026-05-26
🤖 AI

Detecting Unfaithful Chain-of-Thought via Circuit-Guided Internal-External Discrepancy

यह शोध पत्र CIE-Scorer प्रस्तुत करता है, जो एक नवीन ढांचा है जो फ्यूज्ड ग्रोमो-वाटरस्टीन दूरी (Fused Gromov-Wasserstein distance) का उपयोग करके एक मॉडल के आंतरिक कम्प्यूटेशनल सर्किट और उसके बाहरी टेक्स्टुअल ट्रेसेस के बीच विसंगति को कुशलतापूर्वक मापकर अविश्वसनीय चेन-ऑफ-थॉट रीजनिंग (Chain-of-Thought reasoning) का पता लगाता है, जिससे कम कम्प्यूटेशनल लागत के साथ अत्याधुनिक प्रदर्शन प्राप्त होता है।

Xu Shen, Zhen Tan, Song Wang, Pingjun Hong, Rui Miao, Xin Wang, Tianlong Chen2026-05-26
🤖 AI

Back to Parsimonious Latents: Learning Task-Centric World Models from Visual Foundations

यह शोध पत्र TC-WM प्रस्तुत करता है, जो एक ऐसा ढांचा है जो लीनियर प्रोजेक्शन और कॉन्ट्रास्टिव लर्निंग के माध्यम से उच्च-आयामी विजुअल फाउंडेशन मॉडल एम्बेडिंग्स को संक्षिप्त, कार्य-पर्याप्त लेटेंट रिप्रेजेंटेशन्स में परिवर्तित करता है, जिससे विविध वातावरणों में श्रेष्ठ रिवॉर्ड-फ्री ऑफलाइन प्लानिंग और कंट्रोल सक्षम होता है।

Minghao Fu, Fan Feng, Nicklas Hansen, Biwei Huang2026-05-26
🤖 AI

Fine-Tuning and Serving Gemma 4 31B on Google Cloud TPU: A Technical Comparison with GPU Baselines

यह शोध पत्र Google Cloud TPUs पर Gemma 4 31B को फाइन-ट्यूनिंग और सर्व करने के पहले एंड-टू-एंड प्रदर्शन को प्रस्तुत करता है, जिसमें GPU-नेटिव वर्कफ़्लो को JAX स्टैक पर पोर्ट करने के लिए आवश्यक कोड अनुकूलनों का विवरण दिया गया है और यह प्रदर्शित किया गया है कि TPU कॉन्फ़िगरेशन H100 GPU बेसलाइन की तुलना में 1.61x तेज़ प्रशिक्षण और 1.82x कम लागत के साथ तुलनीय इन्फरेंस थ्रूपुट और काफी कम विलंबता (लेटेंसी) प्राप्त करता है।

Jatin Kishnani, Mayank Goel, Amit Singh, Pulkit Agrawal, Sairanjan Mishra2026-05-26
🤖 AI

Posture Clip: Sit properly or I wont let you work

यह शोध पत्र PostureClip प्रस्तुत करता है, जो एक कॉलर-क्लिप किया जाने वाला उपकरण है जो उपयोगकर्ताओं के झुकने पर स्क्रीन को काला करके सही मुद्रा (पोश्चर) लागू करता है, और 165 प्रतिभागियों के साथ 4-सप्ताह के नियंत्रित अध्ययन के माध्यम से यह प्रदर्शित करता है कि इस उपकरण के माध्यम से वास्तविक समय में फीडबैक प्रदान करने से बिना फीडबैक या हस्तक्षेप वाले समूहों की तुलना में मुद्रा कोणों में काफी सुधार होता है और झुके हुए कोणों की अवधि कम होती है।

Arka Majhi, Aparajita Mondal2026-05-26
🤖 AI

Meta-Engineering Harnesses for AI-Native Software Production: A Contract-Driven Adversarial Verification Architecture with Early Deployment Report

यह शोध पत्र एक मेटा-इंजीनियरिंग हार्नेस प्रस्तुत करता है जो आवश्यकताओं को स्पष्ट अनुबंधों में बदलकर, प्रतिकूल सत्यापन (adversarial verification) के साथ भूमिका-विशिष्ट एजेंटों का उपयोग करके, और एक आउटर-लूप कैलिब्रेशन सिस्टम को नियोजित करके, विश्वसनीय, ऑडिट करने योग्य और निरंतर सुधारने योग्य एआई-नेटिव सॉफ्टवेयर उत्पादन को सक्षम बनाता है, जैसा कि छोटे सेवा फर्मों के लिए विकसित तकनीकी बुनियादी ढांचे का प्रबंधन करने वाले एक प्रारंभिक परिनियोजन के माध्यम से प्रदर्शित किया गया है।

Satadru Sengupta, Tamunokorite Briggs, Ivan Myshakivskyi2026-05-26
💬 NLP

Simulating Human Memory with Language Models

यह शोध पत्र प्रदर्शित करता है कि जहाँ आउट-ऑफ-द-बॉक्स भाषा मॉडल मनुष्यों की तुलना में अवास्तविक रूप से विश्वसनीय स्मृति रखते हैं, वहीं विशिष्ट प्रॉम्प्टिंग रणनीतियों और मेमोरी कॉम्पैक्टर को लागू करने से मानव-समान विस्मृति (भूलने की प्रक्रिया) उत्पन्न की जा सकती है, जिससे शैक्षिक संदर्भों में उपयोगकर्ता सिम्युलेटर के रूप में उनकी प्रभावशीलता में सुधार होता है।

Qihan Wang, Nicholas Tomlin, Michael Hu, Brian Dillon, Tal Linzen2026-05-26