💬 NLP

Artificial Phantasia: Emergent Mental Imagery in Large Language Models

यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल (Large Language Models) केवल प्रस्तावात्मक निरूपणों (propositional representations) पर निर्भर रहकर उस कार्य में मनुष्यों से बेहतर प्रदर्शन कर सकते हैं जिसके लिए पारंपरिक रूप से चित्रात्मक मानसिक कल्पना की आवश्यकता होती है, जिससे एक उभरते हुए "कृत्रिम फैंटेसिया" (artificial phantasia) का प्रमाण मिलता है जो इस संज्ञानात्मक विज्ञान के दृष्टिकोण को चुनौती देता है कि दृश्य कल्पना के लिए चित्रात्मक प्रारूप आवश्यक है।

Morgan McCarty, Jorge Morales2026-05-20
🤖 AI

Hybrid Training for Vision-Language-Action Models

यह शोध पत्र हाइब्रिड ट्रेनिंग (HyT) को प्रस्तुत करता है, जो विजन-लैंग्वेज-एक्शन मॉडल्स के लिए एक ऐसा फ्रेमवर्क है जो प्रदर्शन में सुधार करने के लिए प्रशिक्षण के दौरान चेन-ऑफ-थॉट रीजनिंग का लाभ उठाता है, जबकि लेटेंसी को कम करने और वास्तविक दुनिया में उपयोगिता बढ़ाने के लिए मॉडल को इन्फरेंस के दौरान थॉट जनरेशन को छोड़ने की अनुमति देता है।

Pietro Mazzaglia, Cansu Sancaktar, Markus Peschl, Daniel Dijkman2026-05-20
📊 statistics

Proximal Diffusion Neural Sampler

यह शोध पत्र प्रॉक्सिमल डिफ्यूजन न्यूरल सैंपलर (PDNS) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो पाथ मेजर्स (path measures) पर एक प्रॉक्सिमल पॉइंट मेथड के माध्यम से हल किए जाने वाले स्टोकेस्टिक ऑप्टिमल कंट्रोल समस्या के रूप में लर्निंग टास्क को पुनर्गठित करके मल्टीमॉडल डिस्ट्रीब्यूशन से डिफ्यूजन-आधारित सैंपलिंग में होने वाले मोड कोलैप्स (mode collapse) को संबोधित करता है, जो गहन मोड एक्सप्लोरेशन सुनिश्चित करने के लिए प्रक्रिया को सरल उप-समस्याओं की एक श्रृंखला में विभाजित करता है।

Wei Guo, Jaemoo Choi, Yuchen Zhu, Molei Tao, Yongxin Chen2026-05-20
🤖 machine learning

WARC-Bench: Web Archive Based Benchmark for GUI Subtask Executions

यह शोध पत्र WARC-Bench प्रस्तुत करता है, जो जटिल GUI उप-कार्यों (subtasks) पर मल्टीमॉडल AI एजेंटों का मूल्यांकन करने के लिए वेब आर्काइव (Web ARChive) फाइलों का उपयोग करने वाला एक नया बेंचमार्क है, जो यह दर्शाता है कि जहाँ वर्तमान फ्रंटियर मॉडल संघर्ष करते हैं, वहीं ओपन-सोर्स मॉडल प्रतिस्पर्धी प्रदर्शन प्राप्त करने के लिए सुपरवाइज्ड फाइन-ट्यूनिंग और सत्यापन योग्य पुरस्कारों (verifiable rewards) के साथ सुदृढीकरण शिक्षण (reinforcement learning) के माध्यम से महत्वपूर्ण सुधार करते हैं।

Sanjari Srivastava, Gang Li, Cheng Chang, Rishu Garg, Manpreet Kaur, Charlene Y. Lee, Yuezhang Li, Yining Mao, Ignacio C (…)2026-05-20✓ Author reviewed
🤖 AI

Quantum Annealing for Staff Scheduling in Educational Environments

यह शोध पत्र एक क्वांटम एनीलिंग-आधारित अनुकूलन मॉडल प्रस्तुत करता है जो एक वास्तविक इतालवी स्कूली प्रणाली में विभिन्न शैक्षिक स्तरों के बीच जटिल स्टाफ शेड्यूलिंग चुनौतियों को प्रभावी ढंग से हल करता है, जो संसाधन आवंटन के लिए क्वांटम कंप्यूटिंग की व्यावहारिक व्यवहार्यता को प्रदर्शित करता है।

Alessia Ciacco, Francesca Guerriero, Eneko Osaba2026-05-20
💬 NLP

Dr.LLM: Dynamic Layer Routing in LLMs

Dr. LLM एक रेट्रोफिटेबल फ्रेमवर्क है जो प्रीट्रेन्ड LLMs को हल्के वजन वाले, MCTS-सुपरवाइज्ड राउटरों से लैस करता है ताकि ट्रांसफॉर्मर लेयर्स को गतिशील रूप से स्किप करने, निष्पादित करने या दोहराने के लिए, जिससे बेस मॉडल वेट्स को बदले बिना विविध कार्यों में सटीकता में सुधार या उसे बनाए रखते हुए महत्वपूर्ण कंप्यूट बचत प्राप्त की जा सके।

Ahmed Heakl, Martin Gubri, Salman Khan, Sangdoo Yun, Seong Joon Oh2026-05-20
🤖 AI

From Refusal to Recovery: A Control-Theoretic Approach to Generative AI Guardrails

यह शोधपत्र जनरेटिव एआई सुरक्षा के लिए एक नियंत्रण-सिद्धांत आधारित ढांचे का प्रस्ताव करता है जो भंगुर, फ्लैग-एंड-ब्लॉक तंत्र से हटकर मॉडल-अज्ञेय, वास्तविक समय के भविष्य कहनेवाला गार्डरेल्स की ओर स्थानांतरित होता है जो कार्य प्रदर्शन को बनाए रखते हुए विनाशकारी डाउनस्ट्रीम परिणामों को रोकने के लिए जोखिम भरी कार्रवाइयों को सुरक्षित कार्यों में सक्रिय रूप से सुधारने में सक्षम है।

Ravi Pandya, Madison Bland, Duy P. Nguyen, Changliu Liu, Jaime Fernández Fisac, Andrea Bajcsy2026-05-20
🤖 AI

BuildArena: A Physics-Aligned Interactive Benchmark of LLMs for Engineering Construction

यह शोध पत्र BuildArena प्रस्तुत करता है, जो एक नया कार्य डिजाइन रणनीति और एक 3D स्थानिक ज्यामितीय गणना लाइब्रेरी के माध्यम से प्राकृतिक भाषा विनिर्देशों को भौतिक रूप से व्यवहार्य इंजीनियरिंग संरचनाओं में बदलने में बड़े भाषा मॉडलों की क्षमताओं का मूल्यांकन करने वाला पहला भौतिक-संरेखित इंटरैक्टिव बेंचमार्क है।

Tian Xia, Tianrun Gao, Wenhao Deng, Long Wei, Xiaowei Qian, Chenglei Yu, Tailin Wu2026-05-20
🤖 machine learning

Noise-corrected GRPO: From Noisy Rewards to Unbiased Gradients

यह शोध पत्र एक शोर-रोधी (noise-robust) ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO) ढांचे को प्रस्तुत करता है जो रिवॉर्ड भ्रष्टाचार को बरनौली शोर (Bernoulli noise) के रूप में मॉडल करता है और एक सुधार रणनीति लागू करता है जिससे प्रमाणित रूप से निष्पक्ष ग्रेडिएंट प्राप्त होते हैं, जिसके परिणामस्वरूप वास्तविक शोर वाले रिवॉर्ड स्थितियों के तहत गणित और कोड कार्यों पर महत्वपूर्ण सटीकता सुधार होता है।

Omar El Mansouri, Fathinah Asma Izzati, Mohamed El Amine Seddik, Salem Lahlou2026-05-20
🤖 AI

PlantTraitNet: An Uncertainty-Aware Multimodal Framework for Global-Scale Plant Trait Inference from Citizen Science Data

यह शोधपत्र PlantTraitNet को प्रस्तुत करता है, जो एक अनिश्चितता-जागरूक बहुविध (multimodal) डीप लर्निंग फ्रेमवर्क है जो मौजूदा उत्पादों की तुलना में प्रमुख पादप लक्षणों के अधिक सटीक वैश्विक मानचित्र तैयार करने के लिए 5 करोड़ से अधिक जियोटैग्ड नागरिक विज्ञान फोटोग्राफ का लाभ उठाता है, जिससे विरल क्षेत्रीय मापों की सीमाओं को दूर किया जा सके।

Ayushi Sharma, Johanna Trost, Daniel Lusk, Johannes Dollinger, Julian Schrader, Christian Rossi, Javier Lopatin, Etienne (…)2026-05-20