🤖 AI

Recovering Input Text from Hidden States: Study of Gradient-Based Inversion of Decoder-Only Language Models

यह शोध पत्र प्रदर्शित करता है कि डिकोडर-ओनली लैंग्वेज मॉडल्स के अंतिम-लेयर हिडन स्टेट्स मूल टेक्स्ट जितने ही संवेदनशील होते हैं, जो यह दर्शाता है कि एक निरंतर एम्बेडिंग-स्पेस ऑप्टिमाइज़ेशन दृष्टिकोण प्रभावी रूप से इनपुट टोकन्स को रिकवर करता है और यह भी प्रकट करता है कि पुनर्निर्माण की विफलताएं मुख्य रूप से वास्तविक अस्पष्टताओं के बजाय उच्च-आवृत्ति वाले फंक्शन वर्ड्स के कारण होती हैं।

Mikołaj Słowikowski, Maciej Witold Majewski2026-07-02
💻 computer science

How Ethos and Pathos Appeals Resonate in Reader Interpretations of Social Media Messages

यह अध्ययन इस बात की जांच करता है कि कैसे शास्त्रीय अलंकारिक अपील 'एथोस' (ethos) और 'पैथोस' (pathos) सोशल मीडिया पर मूक, सार्वभौमिक दर्शकों को प्रभावित करती है, जो यह प्रकट करता है कि हालांकि व्याख्याएं अक्सर मूल संदेशों से भिन्न होती हैं, फिर भी ये अलंकारिक रणनीतियां स्पष्ट जुड़ाव के बिना भी लेखकों के प्रति दर्शकों के दृष्टिकोण को महत्वपूर्ण रूप से आकार देती हैं।

Ewelina Gajewska, Katarzyna Budzynska, Jaroslaw Chudziak, Liesbeth Allein2026-07-02
💻 computer science

MultiSynt/MT: Trillion-Token Multi-Parallel Pre-Training Data Translated Across 36 Languages

यह शोध पत्र MultiSynt/MT को पेश करता है, जो उच्च गुणवत्ता वाले अंग्रेजी डेटा को अनुवादित करके निर्मित 36 यूरोपीय भाषाओं में 4.8 ट्रिलियन टोकन का एक खुला सिंथेटिक समानांतर संग्रह (parallel corpus) है, जो बहुभाषी LLMs को नेटिव-डेटा बेसलाइन की तुलना में काफी कम प्री-ट्रेनिंग टोकन के साथ बेहतर प्रदर्शन प्राप्त करने में सक्षम बनाता है और साथ ही वर्तमान बेंचमार्क में विशिष्ट मूल्यांकन संबंधी कमियों (blind spots) को भी उजागर करता है।

Maximilian Idahl, Jörg Tiedemann, Sampo Pyysalo, David Salinas, Tomasz Galica, Shenbin Qian, Tudor Nicolae Mateiu, Zihao (…)2026-07-02
💻 computer science

Beyond Document Grounding: Span-Level Hallucination Detection over Code, Tool Output, and Documents

यह शोध पत्र कोड और टूल आउटपुट जैसे विविध संरचित इनपुटों में स्पैन-स्तरीय मतिभ्रम (hallucination) का पता लगाने के लिए एक एकीकृत बेंचमार्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि एक फाइन-ट्यून्ड Qwen3.5-2B मॉडल इन जटिल डोमेन पर मौजूदा डिटेक्टरों और ज़ीरो-शॉट जजों की तुलना में काफी बेहतर प्रदर्शन करता है और साथ ही प्राकृतिक-भाषा RAG बेंचमार्क पर भी प्रतिस्पर्धी बना रहता है।

Ádám Kovács, Bowei He, Xue Liu, István Boros, Szilveszter Tóth, Gábor Recski2026-07-02
💻 computer science

Persona Non Grata: LLM Persona-Driven Generations in MCQA are Unstable in Distinct Dimensions

यह शोध पत्र बहुविकल्पीय प्रश्नोत्तर के लिए बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) में व्यक्तित्व-आधारित जनरेशन (पर्सोना-ड्रिवन जनरेशन) की अस्थिरता की जांच करता है, जो यह प्रकट करता है कि प्रदर्शन मॉडल परिवारों, आकार और डोमेन के आधार पर काफी भिन्न होता है, और तापमान (टेम्परेचर) जैसे अन्य हाइपरपैरामीटर्स की तुलना में प्रॉम्प्ट फॉर्मेट के प्रति अधिक संवेदनशील होता है।

César Guerra-Solano, Xiang Lorraine Li2026-07-02
💻 computer science

Svarna: An Open Corpus Workbench for Modern Greek

यह शोध पत्र स्वर्ण (Svarna) का परिचय देता है, जो एक निःशुल्क, ओपन-सोर्स, वेब-आधारित कॉर्पस वर्कबेंच है जो आधुनिक ग्रीक भाषा की तकनीकी कमियों को दूर करने के लिए 507 मिलियन से अधिक शब्दों वाले पाँच विविध आधुनिक ग्रीक डेटाबेस को एक एकल, सुलभ इंटरफ़ेस में एकीकृत करता है, ताकि बिना किसी इंस्टॉलेशन या विशेष प्रशिक्षण की आवश्यकता के उन्नत खोज, विश्लेषण और एनोटेशन उपकरण प्रदान किए जा सकें।

Stergios Chatzikyriakidis2026-07-02
🤖 machine learning

Logit-Contribution Scoring Identifies Non-Literal Retrieval Heads

यह शोध पत्र लॉजिट-कॉन्ट्रिब्यूशन स्कोरिंग (LOCOS) प्रस्तुत करता है, जो एक नवीन विधि है जो बड़े भाषा मॉडलों में गैर-शाब्दिक रिट्रीवल हेड्स (non-literal retrieval heads) की पहचान करने के लिए उनके आउटपुट-वैल्यू सर्किट के उत्तर टोकन में योगदान को मापती है, और यह प्रदर्शित करती है कि इन विशिष्ट हेड्स को एब्लेट (ablate) करने से अन्य क्षमताओं को सुरक्षित रखते हुए लॉन्ग-कॉन्टेक्स्ट सिंथेसिस प्रदर्शन में महत्वपूर्ण गिरावट आती है।

Aryo Pradipta Gema, Beatrice Alex, Pasquale Minervini2026-07-02
🤖 AI

Behavior-Adaptive Conversational Agents: Toward a Fluid Personality Framework

यह शोध पत्र बड़े भाषा मॉडल-आधारित संवादात्मक एजेंटों के लिए एक फ्लूइड पर्सनैलिटी फ्रेमवर्क (Fluid Personality Framework) प्रस्तावित करता है जो विभिन्न कार्य संदर्भों, उपयोगकर्ता के लक्षणों और स्थिति की तात्कालिकता के अनुरूप ढलने के लिए एजेंट के रूपक व्यक्तित्व (metaphorical persona) और उसके व्यक्तित्व अभिव्यक्ति की तीव्रता दोनों को गतिशील रूप से अनुकूलित करता है, जिससे लक्ष्य-उन्मुख अंतःक्रियाओं में उपयोगकर्ता के विश्वास, आनंद और अंगीकरण को अनुकूलित किया जा सके।

Hasibur Rahman, Smit Desai2026-07-02
💻 computer science

Conversable Complexity: Agentic LLM Collectives as Interpretable Substrates

यह शोध पत्र प्रस्तावित करता है कि स्मृति और उपकरणों से सुसज्जित एजेंटिक लार्ज लैंग्वेज मॉडल्स के समूह, आर्टिफिशियल लाइफ अनुसंधान के लिए एक नवीन, व्याख्यात्मक कम्प्यूटेशनल सबस्ट्रेट के रूप में कार्य कर सकते हैं, जो जटिल उभरते व्यवहारों को सक्षम करते हैं जिन्हें प्राकृतिक भाषा के माध्यम से सीधे पूछताछ योग्य रखा जा सकता है।

Elias Najarro, Ane Espeseth, Eleni Nisioti, Sebastian Risi, Stefano Nichele2026-07-02
🤖 AI

Agentic generation of verifiable rules for deterministic, self-expanding reaction classification

यह शोध पत्र एक पूर्णतः स्वचालित, मल्टी-एजेंट एलएलएम (LLM) फ्रेमवर्क प्रस्तुत करता है जो अमेरिकी पेटेंट डेटा से 14,073 नियतात्मक प्रतिक्रिया नियमों के एक स्व-विस्तारित पुस्तकालय को उत्पन्न और सत्यापित करता है, जो मानव क्यूरेशन के बिना अनदेखी रासायनिक प्रतिक्रियाओं के उच्च-सटीक, व्याख्या योग्य वर्गीकरण को सक्षम बनाता है।

Daniel Armstrong, Maarten Dobbelaere, Valentas Olikauskas, Helena Avila, Octavian Susanu, Jérôme Waser, Philippe Schwall (…)2026-07-02