💻 computer science

Contradiction-Aware Strategy Synthesis in Agent Skills via Loop Engineering: A Controlled Empirical Comparison with Conventional Search

यह शोध पत्र प्रदर्शित करता है कि एक विरोधाभास-जागरूक, लूप-इंजीनियर्ड एआई एजेंट कौशल, उच्च-दांव वाले, निर्णय-स्तर के विदेश-अध्ययन रणनीतियों को उत्पन्न करने में पारंपरिक वेब खोज से स्पष्ट रूप से बेहतर प्रदर्शन करता है, जो बेसलाइन की 0% वैधता और खंडित परिणामों की तुलना में 100% वैधता और व्यापक आउटपुट कवरेज प्राप्त करता है।

Piyush Omanwar2026-07-15
💻 computer science

Detection First, Grading Second: A Secondary Analysis of Stage-Specific Errors in Two-Stage Colon CAD

यह स्थिति-शैली वाला माध्यमिक विश्लेषण तर्क देता है कि कोलन सीएडी (CAD) प्रणालियों को 'डिटेक्शन-फर्स्ट, ग्रेडिंग-सेकंड' वर्कफ़्लो अपनाना चाहिए और चरण-विशिष्ट मेट्रिक्स का उपयोग करके मूल्यांकन किया जाना चाहिए, जो मौजूदा डेटा के पुनर्र्विश्लेषण के माध्यम से यह प्रदर्शित करता है कि ऐसा दृष्टिकोण नैदानिक पैथोलॉजी वर्कफ़्लो के साथ बेहतर तालमेल बिठाता है और यह प्रकट करता है कि ग्रेडिंग त्रुटियों में से अधिकांश नैदानिक रूप से कम गंभीर समीपवर्ती-ग्रेड स्वैप हैं, जबकि यह सकारात्मक भविष्य कहनेवाला मूल्य (PPV) पर रोग प्रसार के महत्वपूर्ण प्रभाव को भी रेखांकित करता है।

Sulav Dahal, Bipul Bhattarai2026-07-15
💻 computer science

Are You Measuring the Failure Subspace, or Its Ceiling?

यह शोध पत्र यह प्रदर्शित करता है कि टेस्ट-टाइम अडैप्टेशन (test-time adaptation) में विफलता उप-स्थानों (failure subspaces) की व्यापक रूप से उद्धृत निम्न-आयामी प्रकृति, क्लासिफायर के रो स्पेस (row space) द्वारा बाधित विशिष्ट ग्रेडिएंट परिभाषाओं का एक बीजगणितीय आर्टिफैक्ट (algebraic artifact) है, न कि एक अंतर्निहित गुण, क्योंकि वैकल्पिक अनकन्स्ट्रेंड डिमांड्स (unconstrained demands) उच्च-आयामी, विड्थ-सेंसिटिव संरचनाओं को प्रकट करते हैं जहाँ अधिकांश ऊर्जा क्लासिफायर के रो स्पेस में ही सीमित रहती है।

Sungmin Ryu2026-07-15
💻 computer science

85.30 GFLOPS Single-Core FP32 Matrix Multiplication on AMD Zen 3: A Systematic Study of Cache Blocking, Register Blocking, FMA Chaining, and On-the-Fly Packing

यह शोध पत्र AMD Zen 3 माइक्रोआर्किटेक्चर पर एक व्यवस्थित अनुकूलन अध्ययन प्रस्तुत करता है जो कैश/रजिस्टर ब्लॉकिंग, FMA चेनिंग और ऑन-द-फ्लाई पैकिंग के 28 विशिष्ट विन्यासों का मूल्यांकन करके सिंगल-कोर FP32 मैट्रिक्स गुणन में 85.30 GFLOPS प्राप्त करता है, जो अंततः एक चैंपियन डिज़ाइन की पहचान करता है जो सैद्धांतिक शिखर प्रदर्शन का 63.5% तक पहुँचता है और भविष्य के अनुकूलन के लिए एक भविष्य कहनेवाला मॉडल पेश करता है।

Lucas Lima Freitag2026-07-15
💻 computer science

A Multimodal Deep Learning Framework for Mental Health Detection Using Social Media Data

यह शोध पत्र एक मल्टीमॉडल डीप लर्निंग फ्रेमवर्क प्रस्तावित करता है जो पारंपरिक मशीन लर्निंग और यूनिमोडल दृष्टिकोणों की तुलना में मानसिक स्वास्थ्य विकारों का अधिक सटीक और शीघ्र पता लगाने के लिए सोशल मीडिया से टेक्स्टुअल, विजुअल और बिहेवियरल डेटा को एकीकृत करता है।

Divya Mishra, Vivek Shukla, Atul, Mehul Kumar Das2026-07-15
💻 computer science

Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop

यह शोध पत्र सस्ते प्रश्नों से फिट किए गए कम-पैरामीटर वाले सरोगेट्स (surrogates) के माध्यम से व्यक्तिगत एजेंटों को बदलकर, एक लैपटॉप पर बड़े एलएलएम-एजेंट (LLM-agent) समाजों को सिम्युलेट करने के लिए एक लागत प्रभावी विधि प्रस्तावित करता है, जो सिमुलेशन सटीकता की भविष्यवाणी करने के लिए एक धारणा-स्मृति वर्गीकरण (perception-memory taxonomy) पेश करता है और कई मैक्रोस्कोपिक परिदृश्यों में इस दृष्टिकोण को मान्य करता है।

Igor Itkin2026-07-15
💻 computer science

High-Performance FP16 General Matrix Multiplication on NVIDIA Ada Lovelace via CUTLASS and WMMA: A Benchmark and Pipeline-Depth Analysis

यह शोध पत्र NVIDIA के Ada Lovelace RTX 4060 पर cuBLAS, CUTLASS और कस्टम WMMA कार्यान्वयन पर FP16 GEMM प्रदर्शन का बेंचमार्किंग करता है, जो यह प्रकट करता है कि तीन की पाइपलाइन गहराई और विशिष्ट टाइल ज्यामिति (tile geometry) के साथ 52.7% पीक थ्रूपुट प्राप्त होता है और यह प्रदर्शित करता है कि पाइपलाइन गहराई के बजाय शेयर्ड-मेमोरी दबाव (shared-memory pressure), आगे के अनुकूलन को सीमित करने वाला प्राथमिक बॉटलनेक है।

Lucas Lima Freitag2026-07-15
💻 computer science

Agentic AI for Code Quality: A Four-Agent Machine Learning System for Repository Refactoring, Public RAG, Groq Reasoning, and Reinforcement Learning

यह शोध पत्र एक मल्टी-एजेंट एआई फ्रेमवर्क प्रस्तुत करता है जो सॉफ्टवेयर रिपॉजिटरीज़ में तकनीकी ऋण (टेक्निकल डेब्ट) को कम करने और कार्यात्मक शुद्धता को बनाए रखते हुए कोड गुणवत्ता सुधारों का स्वायत्त रूप से पता लगाने, उन्हें रिफैक्टर करने और मान्य करने के लिए नियम-आधारित विश्लेषण, पब्लिक RAG, Groq-संचालित LLM रीजनिंग और Q-लर्निंग सुदृढीकरण शिक्षण (रीइन्फोर्समेंट लर्निंग) को एकीकृत करता है।

Abhishek Prithvi Tejs2026-07-15
💻 computer science

Exploring Simulated Morphic Fields for Sustainable Multi-Agent Learning and Education

यह शोध पत्र एक "सिम्युलेटेड मॉर्फिक फील्ड" (एक निरंतर साझा-मेमोरी परत के लिए एक कम्प्यूटेशनल रूपक) का प्रस्ताव करता है, ताकि मल्टी-एजेंट रोबोटिक लर्निंग की दक्षता और स्थिरता को बढ़ाया जा सके और साथ ही इंजीनियरिंग शिक्षा में सामूहिक बुद्धिमत्ता और सिस्टम थिंकिंग सिखाने के लिए एक शैक्षणिक उपकरण के रूप में कार्य किया जा सके।

José Augusto de Lima Prestes, Paulo Victor de Oliveira Miguel, Gilmar Barreto2026-07-15
💻 computer science

PromptCanary Detecting Silent Behavioral Drift in Large Language Model APIs

यह शोधपत्र PromptCanary को प्रस्तुत करता है, जो एक ओपन-सोर्स टूल है जो कस्टमाइज़ेबल प्रॉम्प्ट्स और स्कोरिंग प्रोब्स का उपयोग करके वर्शन्ड बेसलाइन्स के विरुद्ध वर्तमान आउटपुट की तुलना करके लार्ज लैंग्वेज मॉडल (LLM) APIs में साइलेंट बिहेवियरल ड्रिफ्ट का पता लगाने के लिए गोल्डन-मास्टर रिग्रेशन टेस्टिंग लागू करता है।

Min Htet Myet2026-07-15