💬 NLP

SEATauBench: Adapting Tool-Agent-User Evaluation Into Low-Resource Southeast Asian Languages

यह शोध पत्र SEATauBench प्रस्तुत करता है, जो दक्षिण-पूर्व एशियाई संप्रभु एआई (sovereign AI) के लिए पहला मूल्यांकन ढांचा है जो TauBench को पांच क्षेत्रीय भाषाओं के अनुकूल बनाता है, जिससे यह पता चलता है कि हालांकि अंग्रेजी एजेंट की क्षमताएं स्थानीयकृत बातचीत में अच्छी तरह से स्थानांतरित होती हैं, लेकिन जैसे-जैसे कार्य संदर्भ और टूल विशिष्टताएँ पूरी तरह से स्थानीयकृत होती हैं, उनका प्रदर्शन और मजबूती काफी कम हो जाती है।

My Chiffon Nguyen, Aulia Adila, Saksorn Ruangtanusak, Kittiphat Leesombatwathana, Vissuta Gunawan Lim, Patomporn Payoung (…)2026-06-30
💻 computer science

ComMem: Complementary Memory Systems for Test-Time Adaptation of Vision-Language Models

हिप्पोकैम्पस और नियोकोर्टेक्स की पूरक भूमिकाओं से प्रेरित होकर, प्रस्तावित ComMem ढांचा एक तेजी से अनुकूलित होने वाले विजुअल कैश (visual cache) और एक धीमी गति से एकीकृत होने वाले टेक्स्टुअल प्रोटोटाइप सिस्टम का उपयोग करके विजन-लैंग्वेज मॉडल्स के लिए टेस्ट-टाइम एडेप्टेशन को बढ़ाता है, जो क्रॉस-मोडल निरंतरता को संयुक्त रूप से अनुकूलित करता है और विविध वितरण बदलावों (distribution shifts) में बेहतर प्रदर्शन प्राप्त करता है।

Guanglong Sun, Shuang Cui, Bo Lei, Liyuan Wang, Zihan Zhai, Hongwei Yan, Hang Su, Jun Zhu, Yi Zhong2026-06-30
💻 computer science

Agent Safety Is Action Alignment

यह शोध पत्र तर्क देता है कि एजेंट सुरक्षा सुनिश्चित करने के लिए मॉडलों को असुरक्षित इनपुट को अस्वीकार करने के लिए प्रशिक्षित करने से हटकर—एक ऐसी रणनीति जो विफल हो जाती है क्योंकि एजेंटिक हानि हानिकारक सामग्री के बजाय अनधिकृत कार्यों से उत्पन्न होती है—एक्शन बाउंड्री (कार्य सीमा) पर बाहरी तंत्रों के माध्यम से "न्यूनतम विशेषाधिकार" और "एक्शन अलाइनमेंट" को लागू करने की ओर बढ़ने की आवश्यकता है।

Shawn Li, Yue Zhao2026-06-30
💻 computer science

Self-Supervised Theorem Discovery in a Formal Axiomatic System

यह शोध पत्र एक स्व-पर्यवेक्षित एजेंट प्रस्तुत करता है जो केवल स्वयंसिद्धों (axioms) और अनुमान नियमों (inference rules) से शुरू होकर स्वायत्त रूप से हजारों अर्थपूर्ण प्रमेयों की खोज करता है और मानव बेंचमार्क समस्याओं को हल करता है, यह प्रदर्शित करते हुए कि उपयोगी गणितीय ज्ञान बिना किसी मानवीय पूर्वग्रह के उभर सकता है और एलएलएम (LLM) तर्क क्षमता को प्रभावी ढंग से बढ़ा सकता है।

Kazuki Ota, Takayuki Osa, Tatsuya Harada2026-06-30
💻 computer science

Four Types of LLM Reliance and Their Predictors Among Undergraduate Writers: A Mixed-Methods Study at a Minority-Serving R1 University

एक अल्पसंख्यक-सेवा करने वाले R1 विश्वविद्यालय में किए गए इस मिश्रित-पद्धति वाले अध्ययन ने स्नातक स्तर पर LLM निर्भरता के चार विशिष्ट प्रकारों (रणनीतिक, उपकरण संबंधी, संवादात्मक और आश्रित) की पहचान की है, जो यह प्रकट करता है कि AI साक्षरता निर्भरता के प्रकार की भविष्यवाणी करती है जबकि मूल्य और लागत संबंधी विश्वास तीव्रता की भविष्यवाणी करते हैं, और यह भी रेखांकित करता है कि वर्तमान मूल्यांकन पद्धतियां अनजाने में उन रणनीतिक उपयोगकर्ताओं को दंडित करती हैं जो सर्वाधिक स्वतंत्र सोच प्रदर्शित करते हैं।

Shahin Hossain2026-06-30
💻 computer science

Mechanistic Personality Analysis of LLMs Steering Personality via Latent Feature Interventions

यह शोध पत्र एक मैकेनिस्टिक इंटरप्रिटेबिलिटी दृष्टिकोण प्रस्तावित करता है जो स्पार्स ऑटोएनकोडर्स और कंट्रास्टिव एक्टिवेशन विश्लेषण का उपयोग करके OCEAN व्यक्तित्व लक्षणों के अनुरूप लेटेंट फीचर दिशाओं की पहचान करता है, जिससे समग्र भाषा मॉडलिंग प्रदर्शन को बनाए रखते हुए एडिटिव एक्टिवेशन शिफ्ट के माध्यम से लार्ज लैंग्वेज मॉडल्स में इन लक्षणों के नियंत्रणीय स्टीयरिंग को सक्षम बनाया जा सके।

David Courtis, Ting Hu2026-06-30
💬 NLP

Majority Vote Silences Minority Values: Annotator Disagreement at the Hate/Offensive Boundary in HateXplain

यह शोध पत्र यह तर्क देता है कि एनोटेटर असहमति को बहुमत मत लेबल में समेटने की मानक पद्धति घृणा भाषण (हेट स्पीच) डिटेक्शन में एक संरचनात्मक दोष उत्पन्न करती है, जो विवादास्पद सीमावर्ती मामलों को गलत तरीके से 'ग्राउंड ट्रुथ' के रूप में प्रमाणित कर देती है, जिससे मॉडल उन त्रुटियों में उच्च आत्मविश्वास प्रदर्शित करते हैं जिन्हें डाउनस्ट्रीम हस्तक्षेपों द्वारा ठीक नहीं किया जा सकता है।

Joshua Muhumuza, Joab Ezra Agaba, Mercy Amiyo2026-06-30
💻 computer science

HyphaeDB: A Living Knowledge Topology for Agent-First Memory

HyphaeDB एक नवीन एजेंट-नेटिव मेमोरी इंफ्रास्ट्रक्चर पेश करता है जो HNSW वेक्टर ग्राफ को एक निष्क्रिय खोज इंडेक्स से एक सक्रिय संचार फैब्रिक में बदल देता है, जिससे मल्टी-एजेंट सिस्टम गॉसिप प्रोटोकॉल के माध्यम से ज्ञान का प्रसार करने और टोपोलॉजी-ड्रिवन डायनेमिक्स के माध्यम से उभरती हुई समन्वय (emergent coordination) प्राप्त करने में सक्षम होते हैं।

Krishna Halaharvi2026-06-30
💻 computer science

BREIT: A Framework for Brain Stroke Reconstruction using Multi-Frequency 3D EIT

यह शोध पत्र BREIT को प्रस्तुत करता है, जो 3D मल्टी-फ्रीक्वेंसी इलेक्ट्रिकल इम्पीडेंस टोमोग्राफी (MF-EIT) स्ट्रोक पुनर्निर्माण के लिए एक मॉड्यूलर फ्रेमवर्क है जिसमें एक न्यूरोइमेजिंग-टू-EIT पाइपलाइन, एक पायथन फॉरवर्ड सॉल्वर, और एक नवीन dFNO-bar डीप लर्निंग विधि शामिल है जो मौजूदा पुनर्निर्माण तकनीकों की तुलना में सिंथेटिक स्ट्रोक इमेजिंग में बेहतर स्ट्रक्चरल सिमिलरिटी प्रदर्शित करती है।

Djahid Abdelmoumene, Ishak Ayad, Maï K. Nguyen, Christian Daveau2026-06-30
💻 computer science

Categorizing Mathematical Concepts with LLM Voting Ensembles in Mathswitch

यह शोध पत्र मैथस्विच (Mathswitch) प्रोजेक्ट के विकीडेटा-व्युत्पन्न गणितीय अवधारणा अभिलेखों से शोर (noise) को फ़िल्टर करने में लार्ज लैंग्वेज मॉडल्स के एक वोटिंग एन्सेम्बल की प्रभावकारिता का मूल्यांकन करता है, और भविष्य की सुधार रणनीतियों को सूचित करने के लिए विशिष्ट असहमति पैटर्न की पहचान करता है।

Katja Berčič, Slobodan Stanojevikj2026-06-30