🤖 AI

Bridging the Sim-to-Real Gap in Semiconductor Visual Program Synthesis via Input Binarization

यह शोध पत्र एक विजुअल प्रोग्राम सिंथेसिस फ्रेमवर्क प्रस्तावित करता है जो बाइनराइज्ड SEM छवियों को संपादन योग्य DSL कोड में बदलने के लिए एक विजन-लैंग्वेज मॉडल का उपयोग करके सेमीकंडक्टर निरीक्षण में सिम-टू-रियल गैप को पाटता है, जिससे प्रशिक्षण डेटा पीढ़ी के लिए सटीक ज्यामितीय नियंत्रण सक्षम होता है और वास्तविक दुनिया के डेटासेट पर सेगमेंटेशन सटीकता में महत्वपूर्ण सुधार होता है।

Yusuke Ohtsubo, Kota Dohi, Koichiro Yawata, Koki Takeshita, Tatsuya Sasaki2026-06-02
💬 NLP

PaSBench-Video: A Streaming Video Benchmark for Proactive Safety Warning

यह शोध पत्र PaSBench-Video प्रस्तुत करता है, जो एक स्ट्रीमिंग वीडियो बेंचमार्क है और यह दर्शाता है कि वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स समय पर और सटीक प्रोएक्टिव सुरक्षा चेतावनियाँ प्रदान करने में विफल रहते हैं, क्योंकि उन्हें अत्यधिक फॉल्स पॉजिटिव्स को ट्रिगर किए बिना उभरते जोखिमों को सुरक्षित दृश्यों से अलग करने में कठिनाई होती है।

Yusong Zhao, Yuejin Xie, Youliang Yuan, Junjie Hu, Jitian Guo, Yujiu Yang, Pinjia He2026-06-02
🤖 AI

Food Noise & False Safety: A Systematic Evaluation of How LLMs Fail to Adapt to Eating Disorder Queries with Clinician Feedback

यह शोध पत्र व्यवस्थित रूप से इस बात का मूल्यांकन करता है कि कैसे लार्ज लैंग्वेज मॉडल्स (Large Language Models) ईटिंग डिसऑर्डर (खाने के विकार) से ग्रस्त उपयोगकर्ताओं के लिए बिना किसी आलोचनात्मक जांच के असुरक्षित प्रतिक्रियाओं को अनुकूलित करते हैं और उन्हें उत्पन्न करते हैं, जिसमें नैदानिक विशेषज्ञों के सहयोग के माध्यम से उन विशिष्ट भाषाई संकेतों की पहचान की गई है जो नुकसान के जोखिमों को बढ़ाते हैं।

Giulia Pucci, Emily Hemendinger, Ruizhe Li, Gavin Abercrombie, Tanvi Dinkar, Arabella Sinclair2026-06-02
🤖 AI

Initialization is Half the Battle: Generating Diverse Images from a Guidance Potential Posterior

यह शोध पत्र डाइवर्सिटी-इंड्यूसिंग इनिशियलाइजेशन (DivIn) प्रस्तुत करता है, जो एक ऐसी विधि है जो लैंगिविन डायनेमिक्स का उपयोग करके गाइडेंस पोटेंशियल पोस्टीरियर से प्रारंभिक शोर (initial noise) को सैंपल करके जनरेटिव मॉडल की विविधता को बढ़ाती है, जो प्रभावी रूप से ट्रैजेक्टरीज को मोड कोलैप्स से दूर ले जाती है और मौजूदा ट्रैजेक्टरी-आधारित हस्तक्षेपों के साथ संगत और पूरक बनी रहती है।

Xiang Li, Dianbo Liu, Kenji Kawaguchi2026-06-02
💬 NLP

Learning When to Translate for Multilingual Reasoning

यह शोध पत्र Luar को प्रस्तुत करता है, जो एक लैंग्वेज अंडरस्टैंडिंग बाउंड्री-अवेयर रीइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो रीजनिंग लैंग्वेज मॉडल्स को केवल तभी अंग्रेजी अनुवाद का चयनत्मक रूप से आह्वान करने में सक्षम बनाता है जब गैर-अंग्रेजी इनपुट के प्रति उनकी सीधी समझ अविश्वसनीय हो, जिससे अनावश्यक अनुवाद से बचते हुए उनके बहुभाषी तर्क प्रदर्शन में महत्वपूर्ण सुधार होता है।

Deokhyung Kang, Hyounghun Kim, Gary Geunbae Lee2026-06-02
🤖 AI

MCP-Persona: Benchmarking LLM Agents on Real-World Personal Applications via Environment Simulation

यह शोध पत्र MCP-Persona को प्रस्तुत करता है, जो विविध सामाजिक और उद्यम उपकरणों के साथ बातचीत का अनुकरण करके वास्तविक दुनिया के व्यक्तिगत अनुप्रयोगों पर लार्ज लैंग्वेज मॉडल एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया पहला बेंचमार्क है, जो वर्तमान अत्याधुनिक प्रणालियों में महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है।

Wenhao Wang, Peizhi Niu, Gongyi Zou, Xiyuan Yang, Jingxing Wang, Haoting Shi, Yaxin Du, Jingyi Chai, Xianghe Pang, Shuo (…)2026-06-02
💬 NLP

Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools

यह शोध पत्र "घोस्ट टूल कॉल्स" (ghost tool calls) को एक गोपनीयता भेद्यता के रूप में पहचानता है जहाँ अनुमानित टूल इनवोकेशन्स (speculative tool invocations), किसी एजेंट द्वारा किसी शाखा (branch) को प्रतिबद्ध करने से पहले बाहरी पर्यवेक्षकों को उपयोगकर्ता के इरादे को लीक कर देते हैं, और "स्पेक्टिव टूल प्राइवेसी कॉन्ट्रैक्ट्स" (Speculative Tool Privacy Contracts) को एक रनटाइम एब्स्ट्रैक्शन के रूप में प्रस्तावित करता है जो डिस्पैच से पूर्व तर्कों (arguments) और गंतव्यों (destinations) को बदलने या दबाने के लिए इश्यू-टाइम नीतियों को लागू करके इस जोखिम को कम करता है।

Bardia Mohammadi, Lars Klein, Akhil Arora, Laurent Bindschaedler2026-06-02
🤖 AI

Iteris: Agentic Research Loops for Computational Mathematics

यह शोध पत्र इटेरिस (Iteris) को प्रस्तुत करता है, जो कम्प्यूटेशनल गणित की खुली समस्याओं के लिए डिज़ाइन किया गया एक एजेंटिक एआई (agentic AI) सिस्टम है, जिसने सफलतापूर्वक दो जटिल शोध चुनौतियों के लिए संख्यात्मक साक्ष्य, निर्माण और प्रमाण के प्रारूप तैयार किए जिन्हें बाद में मानव विशेषज्ञों द्वारा सत्यापित किया गया।

Leheng Chen, Zihao Liu, Wanyi He, Bin Dong2026-06-02
🤖 AI

Monitoring Agentic Systems Before They're Reliable

यह शोध पत्र एजेंटिक सिस्टम के लिए एक परिपक्वता-चरणबद्ध निगरानी ढांचे का प्रस्ताव करता है जो कार्य-स्तरीय त्रुटियों के बजाय संरचनात्मक दोषों का पता लगाने को प्राथमिकता देता है, जिसमें मूल्यांकन को विचरणात्मक (within-run), अंतर-विचरणात्मक (cross-run) और संरचनात्मक स्कोप के माध्यम से गुणवत्ता, उपयुक्तता और दक्षता आयामों में विभाजित किया गया है, तथा मानव ध्यान को सबसे महत्वपूर्ण एकीकरण अंतराल की ओर निर्देशित करने के लिए विचरण (variance) और FMEA-आधारित ट्राइएज का उपयोग किया गया है।

Marisa Ferrara Boston, Glen Hanson, Effi Georgala, JD Hudgens, Heather Frase2026-06-02
🤖 AI

Tracking the Behavioral Trajectories of Adapting Agents

यह शोध पत्र एजेंट व्यवहारिक लक्षणों को टेक्स्ट एम्बेडिंग स्पेस में दिशाओं के रूप में परिभाषित करके उन्हें मापने के लिए एक ढांचे का परिचय देता है, जो कौशल फ़ाइल संपादन (skill file edits) को मापने में सक्षम बनाता है और एक विश्वसनीय मध्यस्थ के माध्यम से व्यवहारिक परिवर्तनों के सुरक्षित एजेंट-से-एजेंट मूल्यांकन की सुविधा प्रदान करता है।

Jonah Leshin, Manish Shah, Ian Timmis2026-06-02