🤖 AI

High-quality generation of dynamic game content via small language models: A proof of concept

यह शोध पत्र विशेष रूप से सिंथेटिक रूप से जनरेट किए गए, संकीर्ण रूप से केंद्रित कार्यों पर आक्रामक रूप से फाइन-ट्यून किए गए विशिष्ट छोटे भाषा मॉडलों (SLMs) का उपयोग करके उच्च-गुणवत्ता वाली, वास्तविक समय की गतिशील गेम सामग्री उत्पन्न करने के लिए एक प्रूफ-ऑफ-कॉन्सेप्ट रणनीति का प्रस्ताव और सत्यापन करता है, जिससे बड़े भाषा मॉडलों की नैरेटिव विसंगति और क्लाउड-निर्भरता की सीमाओं को दूर किया जा सके।

Morten I. K. Munk, Arturo Valdivia, Paolo Burelli2026-05-20
🔬 physics

WIND: Weather Inverse Diffusion for Zero-Shot Atmospheric Modeling

यह शोध पत्र WIND को प्रस्तुत करता है, जो एक ज़ीरो-शॉट वायुमंडलीय फाउंडेशन मॉडल है जो एक कार्य-अज्ञेय (task-agnostic) प्रायर सीखने के लिए स्व-पर्यवेक्षित वीडियो डिफ्यूजन का लाभ उठाता है, जिससे यह किसी भी कार्य-विशिष्ट फाइन-ट्यूनिंग की आवश्यकता के बिना, इनवर्स प्रॉब्लम सैंपलिंग के माध्यम से पूर्वानुमान, डाउनस्केलिंग और पुनर्निर्माण सहित विविध मौसम और जलवायु समस्याओं को हल करने में सक्षम होता है।

Michael Aich, Andreas Fürst, Florian Sestak, Carlos Ruiz-Gonzalez, Niklas Boers, Johannes Brandstetter2026-05-20
🤖 machine learning

Rethinking the Design Space of Reinforcement Learning for Diffusion Models: On the Importance of Likelihood Estimation Beyond Loss Design

यह शोध पत्र डिफ्यूजन मॉडल्स के लिए सुदृढीकरण शिक्षण (reinforcement learning) डिज़ाइन स्पेस का व्यवस्थित रूप से विश्लेषण करता है और यह प्रदर्शित करता है कि अंतिम जनरेट किए गए नमूने से गणना किया गया एक एविडेंस लोअर बाउंड (ELBO) आधारित लाइकलीहुड एस्टीमेटर उपयोग करना ही कुशल और स्थिर अनुकूलन को सक्षम करने वाला महत्वपूर्ण कारक है, जो गति और रिवॉर्ड दोनों बेंचमार्क में मौजूदा विधियों से काफी बेहतर प्रदर्शन करता है।

Jaemoo Choi, Yuchen Zhu, Wei Guo, Petr Molodyk, Bo Yuan, Jinbin Bai, Yi Xin, Molei Tao, Yongxin Chen2026-05-20
🧬 biology

How does longer temporal context enhance multimodal narrative video processing in the brain?

यह अध्ययन प्रदर्शित करता है कि वीडियो क्लिप के टेम्पोरल कॉन्टेक्स्ट (कालिक संदर्भ) को बढ़ाने से मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स (लेकिन यूनिमोडल वीडियो मॉडल्स के लिए नहीं) के लिए ब्रेन-मॉडल अलाइनमेंट में महत्वपूर्ण सुधार होता है, जो नैरेटिव कॉम्प्रिहेन्शन (कथा बोध) के दौरान उच्च-क्रम मस्तिष्क क्षेत्रों में लंबी न्यूरल इंटीग्रेशन टाइमस्केल्स और MLLMs की गहरी परतों के बीच एक पदानुक्रमित पत्राचार को प्रकट करता है।

Prachi Jindal, Anant Khandelwal, Manish Gupta, Bapi S. Raju, Subba Reddy Oota, Tanmoy Chakraborty2026-05-20
💬 NLP

Language Model Memory and Memory Models for Language

यह शोध पत्र तर्क देता है कि मानक नेक्स्ट-टोकन प्रेडिक्शन प्रशिक्षण स्मृति के लिए अनुपयुक्त और सूचना-विहीन एम्बेडिंग उत्पन्न करता है, और उच्च-सटीक स्मृति निर्माण और कम्प्यूटेशनल दक्षता प्राप्त करने के लिए संयुक्त कॉज़ल (causal) और सूचना-प्रतिधारण उद्देश्यों के साथ प्रशिक्षित एक समानांतर योग्य एनकोडर-डिकोडर आर्किटेक्चर का प्रस्ताव करता है।

Benjamin L. Badger2026-05-20
🤖 AI

Designing escalation criteria for international AI incident response: criteria, triggers, and thresholds

यह शोध पत्र एक परिचालन एस्केलेशन फ्रेमवर्क (operational escalation framework) प्रस्तावित करता है जिसमें आठ मानदंड और एक निर्णय फ्लोचार्ट है ताकि यह मार्गदर्शन किया जा सके कि कब एआई (AI) घटनाओं को राष्ट्रीय से अंतर्राष्ट्रीय स्तर पर संभालने के लिए एस्केलेट किया जाना चाहिए, साथ ही तीन ऐसे डिज़ाइन पैटर्न की पहचान की गई है जो वर्तमान में मौजूदा नियामक व्यवस्थाओं में व्यवस्थित रूप से कम-पता लगाने (under-detection) का कारण बनते हैं।

Francesca Gomez, Matthew Ball, Michael Harre, Lydia Preston, Josephine Schwab, Caio Machado2026-05-20
🤖 AI

Skim: Speculative Execution for Fast and Efficient Web Agents

Skim एक स्पेक्युलेटिव एक्जीक्यूशन फ्रेमवर्क है जो अधिकांश क्वेरीज़ के लिए भारी-भरकम इन्फरेंस कंपोनेंट्स को बायपास करने के लिए अनुमानित वेबसाइट संरचनाओं का लाभ उठाकर वेब एजेंट्स की लागत और लेटेंसी को काफी कम कर देता है, जबकि सटीकता सुनिश्चित करने के लिए एक हल्के वर्िफायर का उपयोग करता है और दुर्लभ विफलताओं को निर्बाध रूप से पूर्ण एजेंट्स तक पहुँचाता है।

Mike Wong, Kevin Hsieh, Suman Nath, Ravi Netravali2026-05-20
🤖 AI

SLEIGHT-Bench: A Benchmark of Evasion Attacks Against Agent Monitors

यह शोध पत्र SLEIGHT-Bench को प्रस्तुत करता है, जो 11 श्रेणियों में 40 सिंथेटिक कोडिंग एजेंट हमलों का एक बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान LLM-आधारित मॉनिटर सूक्ष्म बचाव रणनीतियों (evasion strategies) का पता लगाने में संघर्ष करते हैं, केवल 32% कैच रेट प्राप्त करते हैं और बेहतर निगरानी तकनीकों की आवश्यकता पर प्रकाश डालते हैं।

Elle Najt, Colin Toft, Tyler Tracy, Fabien Roger, Joe Benton2026-05-20
🤖 AI

PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems

PrivScope हाइब्रिड एजेंटिक सिस्टम्स के लिए एक विश्वसनीय ऑन-डिवाइस पेलोड गवर्नर है जो अप्रासंगिक संदर्भ को फ़िल्टर करके और संवेदनशील विवरणों को उनके सबसे कम-प्रकटीकरण वाले रूप में संक्षिप्त करके कार्य-आधारित प्रकटीकरण नियंत्रण को लागू करता है, जिससे विभिन्न क्लाउड लैंग्वेज मॉडल्स में उच्च कार्य सफलता दर बनाए रखते हुए प्रोफाइल लीकेज को समाप्त करता है और पुन: पहचान के जोखिमों को कम करता है।

Shafizur Rahman Seeam (Ian), Zhengxiong Li (Ian), Zhiyuan Yu (Ian), Yimin (Ian), Chen, Yidan Hu2026-05-20
💻 computer science

Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment

यह अध्ययन प्रकट करता है कि जहाँ बड़े भाषा मॉडल भावनाओं और छवि संबंधी विशेषताओं के संबंध में मानवीय सौंदर्य मूल्यांकन पैटर्न का अनुमान लगा सकते हैं, वहीं वे शारीरिक संवेदनाओं जैसे अंतःप्रceptिव (interoceptive) पहलुओं में महत्वपूर्ण विचलन प्रदर्शित करते हैं, जो वर्तमान एआई संरेखण (AI alignment) और प्रशिक्षण डेटा प्रतिनिधित्व की गंभीर सीमाओं को रेखांकित करता है।

Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi2026-05-20