🤖 AI

CryptoAnalystBench: Failures in Multi-Tool Long-Form LLM Analysis

यह शोध पत्र CryptoAnalystBench प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन ढांचा है जिसे उच्च-घनत्व वाले क्रिप्टो और DeFi डेटा पर जटिल, मल्टी-टूल विश्लेषण करने के दौरान अत्याधुनिक LLM एजेंटों में महत्वपूर्ण विफलता मोड को उजागर करने और वर्गीकृत करने के लिए डिज़ाइन किया गया है, जो अंततः दीर्घकालिक विश्लेषणात्मक तर्क (long-form analytical reasoning) में सुधार के लिए एक परिष्कृत वर्गीकरण और स्केलेबल फीडबैक तंत्र प्रदान करता है।

Anushri Eswaran, Oleg Golev, Darshan Tank, Sidhant Rahi, Himanshu Tyagi2026-03-26
💻 computer science

Benchmarking Post-Quantum Cryptography on Resource-Constrained IoT Devices: ML-KEM and ML-DSA on ARM Cortex-M0+

यह शोध पत्र संसाधन-सीमित ARM Cortex-M0+ प्रोसेसर पर अंतिम रूप से निर्धारित NIST पोस्ट-क्वांटम मानकों ML-KEM और ML-DSA के पहले व्यवस्थित बेंचमार्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि ML-KEM-512, ECDH P-256 की तुलना में काफी तेज़ और अधिक ऊर्जा-कुशल है, जबकि रिजेक्शन सैंपलिंग (rejection sampling) के कारण ML-DSA साइनिंग में उच्च विलंबता भिन्नता (latency variance) को उजागर करता है।

Rojin Chhetri2026-03-26
💻 computer science

The HyperFrog Cryptosystem: High-Genus Voxel Topology as a Trapdoor for Post-Quantum KEMs

यह शोध पत्र हाइपरफ्रॉग (HyperFrog) पोस्ट-क्वांटम की एनकैप्सुलेशन मैकेनिज्म (Key Encapsulation Mechanism) के एक संशोधित विनिर्देश को प्रस्तुत करता है, जो एक मानक अनस्ट्रक्चर्ड लर्निंग विद एरर्स (Learning With Errors) कोर को बनाए रखता है लेकिन एक 16×16×16 वोक्सेल ग्रिड पर एक कनेक्टेड फ्रंटियर ग्रोथ प्रोसेस (connected frontier growth process) पर आधारित एक नवीन, औपचारिक रूप से परिभाषित गुप्त वितरण पेश करता है जो 2048 के सटीक ऑक्यूपाइड वेट (occupied weight) और एक ट्यूनेबल ग्राफ साइकिल रैंक थ्रेशोल्ड (graph cycle rank threshold) को लागू करता है, जबकि औपचारिक सुरक्षा दावों को इंजीनियरिंग कार्यान्वयन मोड से स्पष्ट रूप से अलग करता है और एक पारदर्शी बेंचमार्क सुइट प्रदान करता है जो क्रिप्टोग्राफिक लागतों और पासवर्ड-आधारित की अनलॉक लेटेंसी (password-based key unlock latencies) के बीच के अंतर को स्पष्ट करता है।

Victor Duarte Melo2026-03-26
💬 NLP

Internal Safety Collapse in Frontier Large Language Models

यह शोध पत्र "आंतरिक सुरक्षा पतन" (Internal Safety Collapse) की पहचान करता है, जो फ्रंटियर लार्ज लैंग्वेज मॉडल्स में एक महत्वपूर्ण विफलता मोड है जहाँ जटिल, डोमेन-विशिष्ट कार्य अनजाने में मॉडलों को हानिकारक सामग्री उत्पन्न करने के लिए मजबूर कर देते हैं, जिससे यह प्रकट होता है कि उन्नत क्षमताएं और संरेखण प्रयास उच्च-जोखिम वाले पेशेवर परिवेशों में अंतर्निहित सुरक्षा जोखिमों को समाप्त नहीं कर सकते हैं।

Yutao Wu, Xiao Liu, Yifeng Gao, Xiang Zheng, Hanxun Huang, Yige Li, Cong Wang, Bo Li, Xingjun Ma, Yu-Gang Jiang2026-03-26
💻 computer science

CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training

यह शोध पत्र ReCAP को प्रस्तुत करता है, जो एक नेटिव GUI एजेंट है जो एक गतिशील मूल्यांकन प्रणाली, स्वचालित तर्क-क्रिया डेटा जनरेशन और विफलता प्रक्षेपवक्रों (failure trajectories) पर स्व-सुधारात्मक प्रशिक्षण का उपयोग करके मजबूत CAPTCHA समाधान प्राप्त करता है और सामान्य GUI प्रदर्शन बनाए रखता है।

Yuxi Chen, Haoyu Zhai, Chenkai Wang, Rui Yang, Lingming Zhang, Gang Wang, Huan Zhang2026-03-26
💻 computer science

n-VM: A Multi-VM Layer-1 Architecture with Shared Identity and Token State

यह शोध पत्र n-VM को प्रस्तुत करता है, जो एक नवीन लेयर-1 आर्किटेक्चर है जो क्रॉस-चेन विखंडन (fragmentation) को समाप्त करने के लिए एक साझा सर्वसम्मति (consensus), पहचान और टोकन अवस्था के तहत कई विषम वर्चुअल मशीनों को एकीकृत करता है और समानांतर निष्पादन (parallel execution) एवं संदर्भ-आधारित शार्डिंग (context-based sharding) के माध्यम से उच्च थ्रूपुट प्राप्त करता है।

Jian Sheng Wang2026-03-26
💻 computer science

Leveraging Large Language Models for Trustworthiness Assessment of Web Applications

यह शोध पत्र एक ऐसी अनुभवजन्य कार्यप्रणाली का प्रस्ताव करता है जो वेब अनुप्रयोगों के विश्वासयोग्यता मूल्यांकन को स्वचालित करने के लिए लार्ज लैंग्वेज मॉडल्स (Large Language Models) का लाभ उठाती है, जो सुरक्षित कोडिंग प्रथाओं को सत्यापित करती है और एक समग्र विश्वासयोग्यता स्कोर उत्पन्न करने के लिए उनके आउटपुट को एक पदानुक्रमित गुणवत्ता मॉडल (hierarchical Quality Model) में एकीकृत करती है।

Oleksandr Yarotskyi, José D'Abruzzo Pereira, João R. Campos2026-03-26
💻 computer science

The Cognitive Firewall:Securing Browser Based AI Agents Against Indirect Prompt Injection Via Hybrid Edge Cloud Defense

यह शोध पत्र 'कॉग्निटिव फायरवॉल' (Cognitive Firewall) को प्रस्तुत करता है, जो एक हाइब्रिड एज-क्लाउड आर्किटेक्चर है जो स्थानीय दृश्य फ़िल्टरिंग (visual filtering), क्लाउड-आधारित सिमेंटिक विश्लेषण और नियतात्मक निष्पादन नीतियों (deterministic execution policies) को जोड़कर ब्राउज़र-आधारित एआई एजेंटों को अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन से प्रभावी ढंग से सुरक्षित करता है ताकि न्यूनतम विलंबता के साथ लगभग शून्य हमले की सफलता दर प्राप्त की जा सके।

Qianlong Lan, Anuj Kaul2026-03-26
💬 NLP

How Vulnerable Are Edge LLMs?

यह शोध पत्र यह प्रदर्शित करता है कि केवल क्वांटाइजेशन (quantization) ही एज-डिप्लॉयड (edge-deployed) एलएलएम (LLMs) को ज्ञान निष्कर्षण हमलों (knowledge extraction attacks) से बचाने में विफल रहता है, और मानक क्वेरी विधियों की तुलना में क्वांटाइज्ड मॉडलों से सिमेंटिक जानकारी को अधिक कुशलता से व्यवस्थित रूप से पुनर्प्राप्त करने के लिए CLIQ फ्रेमवर्क पेश करता है।

Ao Ding, Hongzong Li, Zi Liang, Zhanpeng Shi, Shuxin Zhuang, Shiqin Tang, Rong Feng, Ping Lu2026-03-26
💻 computer science

An Adaptive Neuro-Fuzzy Blockchain-AI Framework for Secure and Intelligent FinTech Transactions

यह शोध पत्र एडेप्टिव न्यूरो-फजी ब्लॉकचेन-एआई फ्रेमवर्क (ANFB-AI) का प्रस्ताव करता है, जो जटिल धोखाधड़ी का वास्तविक समय में प्रभावी ढंग से पता लगाने के लिए एक अनुमत (permissioned) ब्लॉकचेन को एक एडेप्टिव न्यूरो-फजी लर्निंग मॉडल के साथ एकीकृत करता है, जिससे सटीकता और विलंबता (latency) में अत्याधुनिक एल्गोरिदम से बेहतर प्रदर्शन करते हुए FinTransaction सुरक्षा को बढ़ाया जा सके।

Gunjan Mishra, Yash Mishra2026-03-26