🔬 physics

Improving Molecular Force Fields with Minimal Temporal Information

यह शोध पत्र FRAMES को प्रस्तुत करता है, जो एक नवीन प्रशिक्षण रणनीति है जो एक सहायक लॉस फंक्शन के माध्यम से केवल दो क्रमिक आणविक गतिशीलता (मॉलिक्यूलर डायनेमिक्स) फ्रेम से न्यूनतम टेम्पोरल जानकारी का लाभ उठाकर मॉलिक्यूलर फोर्स फील्ड्स की ऊर्जा और बल भविष्यवाणी की सटीकता में महत्वपूर्ण सुधार करती है, जो यह प्रदर्शित करता है कि लंबे प्रक्षेपवक्र अनुक्रमों (ट्रैजेक्टरी सीक्वेंस) को जोड़ने से वास्तव में प्रदर्शन में गिरावट आ सकती है।

Ali Mollahosseini, Mohammed Haroon Dupty, Wee Sun Lee2026-04-23
💻 computer science

MIRROR: A Hierarchical Benchmark for Metacognitive Calibration in Large Language Models

MIRROR बेंचमार्क यह प्रकट करता है कि बड़े भाषा मॉडल बहु-डोमेन कार्यों पर अपने स्वयं के प्रदर्शन की भविष्यवाणी करने में सार्वभौमिक रूप से विफल रहते हैं और आंशिक आत्म-ज्ञान को बेहतर निर्णय लेने में प्रभावी ढंग से अनुवादित नहीं कर सकते हैं, जो यह सुझाव देता है कि सुरक्षित स्वायत्त एआई प्रणालियों के लिए बेहतर आत्म-जागरूकता के बजाय बाहरी मेटाकॉग्निटिव स्कैफोल्डिंग (metacognitive scaffolding) आवश्यक है।

Jason Z Wang2026-04-23
💻 computer science

Model Capability Assessment and Safeguards for Biological Weaponization

यह शोध पत्र कई उन्नत एआई मॉडलों को सौहार्दपूर्ण (benign) स्टेम (STEM) कार्यों पर बेंचमार्क करता है और जेमिनी (Gemini) में महत्वपूर्ण सुरक्षा अंतराल की पहचान करता है, जो विशिष्ट परिस्थितियों में हानिकारक जैविक हथियार बनाने के निर्देशों को उत्पन्न करने की इसकी क्षमता को प्रदर्शित करता है, जिससे बेहतर सुरक्षा उपायों और अद्यतन अमेरिकी नीतिगत प्रतिक्रियाओं की तत्काल आवश्यकता पर बल मिलता है।

Michael Richter2026-04-23
💻 computer science

Emergence Transformer: Dynamical Temporal Attention Matters

यह शोध पत्र इमर्जेंस ट्रांसफॉर्मर (Emergence Transformer) का परिचय देता है, जो जटिल प्रणालियों में उभरती सामंजस्यता (emergent coherence) को नियंत्रित करने के लिए समय-परिवर्तनीय मैट्रिसेस के साथ गतिशील टेम्पोरल अटेंशन (dynamical temporal attention) का उपयोग करने वाला एक नवीन आर्किटेक्चर है, जो दोलनी सिंक्रोनाइज़ेशन (oscillatory synchronization) को बढ़ाने, सामाजिक सहमति को नया रूप देने और हॉपफील्ड नेटवर्क (Hopfield networks) में कैटास्ट्रोफिक फॉरगेटिंग (catastrophic forgetting) के बिना निरंतर सीखने में सक्षम होने की अपनी क्षमता प्रदर्शित करता है।

Zihan Zhou, Bo-Wei Qin, Kai Du, Wei Lin2026-04-23
💻 computer science

JTPRO: A Joint Tool-Prompt Reflective Optimization Framework for Language Agents

यह शोध पत्र JTPRO को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो बड़े, डोमेन-विशिष्ट टूल इन्वेंट्रीज़ में टूल चयन और आर्गुमेंट इंस्टेंशिएशन (argument instantiation) की सटीकता को महत्वपूर्ण रूप से सुधारने के लिए रोलआउट-संचालित रिफ्लेक्शन (rollout-driven reflection) के माध्यम से ग्लोबल एजेंट इंस्ट्रक्शन्स और प्रति-टूल स्कीमा विवरणों को पुनरावृत्ति (iteratively) के साथ सह-अनुकूलित (co-optimizes) करता है।

Sandip Ghoshal, Anshul Mittal, Jyotika Singh, Miguel Ballesteros, Weiyi Sun, Fang Tu, Shailender Singh, Yassine Benajiba (…)2026-04-23
💻 computer science

SolidCoder: Bridging the Mental-Reality Gap in LLM Code Generation through Concrete Execution

SolidCoder एक S.O.L.I.D. आर्किटेक्चर द्वारा अविश्वसनीय मानसिक सिमुलेशन को प्रतिस्थापित करके और एज-केस जागरूकता एवं सैंडबॉक्स्ड निष्पादन को लागू करके LLM कोड जनरेशन में मेंटल-रियलिटी गैप को पाटता है, जिससे कई बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Woojin Lee, Jin-Xia Huang2026-04-23
💻 computer science

Co-Located Tests, Better AI Code: How Test Syntax Structure Affects Foundation Model Code Generation

यह शोध पत्र एक बड़े पैमाने पर अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि टेस्ट सिंटैक्स को कार्यान्वयन कोड (इम्प्लीमेंटेशन कोड) के साथ सह-स्थित करना, अलग किए गए टेस्ट स्ट्रक्चर की तुलना में विविध फाउंडेशन मॉडल्स और आर्किटेक्चर में एआई-जनरेटेड कोड की गुणवत्ता, शुद्धता और संरक्षण में महत्वपूर्ण रूप से सुधार करता है।

Éric Jacopin2026-04-23
💻 computer science

Forage V2: Knowledge Evolution and Transfer in Autonomous Agent Organizations

Forage V2 एक स्वायत्त एजेंट संगठन आर्किटेक्चर पेश करता है जो मॉडल क्षमताओं के बीच ज्ञान संचय और हस्तांतरण को संस्थागत बनाकर ओपन-वर्ल्ड कार्यों में "डेनोमिनेटर ब्लाइंडनेस" (denominator blindness) पर विजय प्राप्त करता है, जिससे साझा, मॉडल-अज्ञेय (model-agnostic) संगठनात्मक स्मृति के माध्यम से कमजोर एजेंटों को बेहतर प्रदर्शन, कम लागत और तेज़ अभिसरण (convergence) प्राप्त करने में सक्षम बनाया जा सके।

Huaqing Xie2026-04-23
💻 computer science

Environmental Understanding Vision-Language Model for Embodied Agent

यह शोध पत्र एनवायर्नमेंटल अंडरस्टैंडिंग एम्बोडीड एजेंट (EUEA) फ्रेमवर्क का प्रस्ताव करता है, जो चार मुख्य पर्यावरणीय समझ कौशल को फाइन-ट्यून करके और ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन के साथ एक रिकवरी मैकेनिज्म को शामिल करके एम्बोडीड कार्यों के लिए विजन-लैंग्वेज मॉडल्स को उन्नत करता है, जिसके परिणामस्वरूप व्यवहार-क्लोनिंग बेसलाइन्स की तुलना में ALFRED बेंचमार्क पर सफलता दर में 8.86% का सुधार होता है।

Jinsik Bang, Jaeyeon Bae, Donggyu Lee, Siyeol Jung, Taehwan Kim2026-04-23
💻 computer science

If you're waiting for a sign... that might not be it! Mitigating Trust Boundary Confusion from Visual Injections on Vision-Language Agentic Systems

यह शोध पत्र विज़न-लैंग्वेज एजेंटिक सिस्टम्स में "ट्रस्ट बाउंड्री कन्फ्यूजन" (विश्वास सीमा भ्रम) की पहचान और समाधान करता है, जहाँ एजेंट वैध पर्यावरणीय संकेतों और दुर्भावनापूर्ण विज़ुअल इंजेक्शन के बीच अंतर करने में संघर्ष करते हैं, और एक ड्यूल-इंटेंट मूल्यांकन ढांचे को पेश करता है जो वर्तमान कमजोरियों को उजागर करता है तथा एक मल्टी-एजेंट रक्षा तंत्र का प्रस्ताव देता है जो मजबूती सुनिश्चित करने के लिए धारणा (परसेप्शन) को निर्णय लेने से अलग करता है।

Jiamin Chang, Minhui Xue, Ruoxi Sun, Shuchao Pang, Salil S. Kanhere, Hammond Pearce2026-04-23