💬 NLP

Large Language Models Do Not Always Need Readable Language

यह शोध पत्र "BabelTele" को प्रस्तुत करता है, जो एक मॉडल-केंद्रित पाठ्य प्रतिनिधित्व है जो उच्च सूचना घनत्व और अर्थपूर्ण निष्ठा प्राप्त करने के लिए मानवीय पठनीयता का त्याग करता है, यह प्रदर्शित करते हुए कि बड़े भाषा मॉडल कुशल मशीन-से-मशीन संचार के लिए संक्षिप्त, गैर-मानक स्वरूपों को प्रभावी ढंग से उत्पन्न और व्याख्या कर सकते हैं।

Jiayi Zhu, Haoxuan Peng, Junxi Wang, Liang Ke, Chen Zhang, Linfeng Zhang2026-06-19
⚡ electrical engineering

Light-weight Pronunciation Assessment via Discrete Speech Token Surprisal

यह शोध पत्र एक हल्का, अनसुपरवाइज्ड उच्चारण मूल्यांकन ढांचा प्रस्तावित करता है जो शिक्षार्थी की त्रुटियों का प्रभावी ढंग से पता लगाने के लिए केवल मूल भाषण पर प्रशिक्षित डिस्क्रीट स्पीच टोकन सरप्राइज़ल और ट्रांसक्रिप्ट-गाइडेड Text2DUnit–DTW अलाइनमेंट मॉड्यूल का लाभ उठाता है, जिससे बेंचमार्क डेटासेट पर सुपरवाइज्ड बेसलाइन्स के तुलनीय प्रदर्शन प्राप्त होता है।

Syeda Faiza Ahmed Sara, Shammur Absar Chowdhury2026-06-19
💬 NLP

GEMS: Geometric Constraints Enable Multi-Semantic Superposition in LLMs

यह शोध पत्र GEMS का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त विधि है जो वितरण विचलन (distributional deviation) और दिशात्मक हस्तक्षेप (directional interference) को कम करने के लिए ज्यामितीय बाधाओं—विशेष रूप से नॉर्म-प्रिजर्विंग वेटेड सुपरपोजिशन और रियल-टाइम ऑर्थोगोनलाइजेशन—को लागू करके LLMs में स्थिर बहु-सिमेंटिक सुपरपोजिशन को सक्षम बनाती है, जिससे समवर्ती सक्रियता स्टीयरिंग (concurrent activation steering) के दौरान मॉडल कोलैप्स को रोका जा सके।

Yu Deng2026-06-19
💬 NLP

Generative Engine Optimization at Scale: Measuring Brand Visibility Across AI Search Engines

यह शोध पत्र 1,00,000 से अधिक एआई (AI) खोज प्रतिक्रियाओं का विश्लेषण करके जेनेरेटिव इंजन ऑप्टिमाइज़ेशन (GEO) के लिए एक बड़े पैमाने का आधार रेखा (baseline) स्थापित करता है, जिससे यह पता चलता है कि ब्रांड दृश्यता परिपक्वता द्वारा अत्यधिक स्तरित है, प्राथमिक स्रोतों के रूप में कॉर्पोरेट वेबसाइटों और "बेस्ट-ऑफ" लिस्टिकल्स (best-of listicles) का पक्ष लेती है, और अत्यधिक अस्थिर भावना प्रदर्शित करती है, जिससे इस प्रकार ब्रांडों के लिए अपनी एआई खोज उपस्थिति में सुधार करने हेतु व्यावहारिक प्रोटोकॉल प्राप्त होते हैं।

Pratyush Kumar (Ranqo)2026-06-19
💬 NLP

Self-Preference Is Weak or Absent in Verifiable Instruction-Following Revision: A Four-Model Test Under Genuine Authorship

यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल अपने स्वयं के ड्राफ्ट के सत्यापित, निर्देश-अनुपालन सुधारों को अस्वीकार करते समय स्व-वरीयता पूर्वाग्रह (self-preference bias) प्रदर्शित नहीं करते हैं, क्योंकि वे ऐसे सुधारों को तटस्थ तीसरे पक्ष के मॉडलों के समान दरों पर स्वीकार या अस्वीकार करते हैं जो सांख्यिकीय रूप से अविभेद्य हैं।

William Guey, Pierrick Bougault2026-06-19
💬 NLP

HydraHead: From Head-Level Functional Heterogeneity to Specialized Attention Hybridization

हाइड्राहेड (HydraHead) एक नवीन आर्किटेक्चर है जो हेड स्तर पर फुल और लीनियर अटेंशन को हाइब्रिडाइज करके अटेंशन की क्वाड्रेटिक जटिलता को संबोधित करता है, जो न्यूनतम प्रशिक्षण ओवरहेड के साथ बेहतर लॉन्ग-कॉन्टेक्स्ट प्रदर्शन प्राप्त करने के लिए इंटरप्रिटेबिलिटी-ड्रिवन सिलेक्शन और स्केल-नॉर्मलाइज्ड फ्यूजन का लाभ उठाता है।

Zhentao Tan, Wei Chen, Jingyi Shen, Yao Liu, Xu Shen, Yue Wu, Jieping Ye2026-06-19
💬 NLP

When Does Streaming Tool Use Help? Characterizing Tool-Intent Stabilization in Streaming Retrieval-Augmented Generation

यह शोध पत्र स्ट्रीमिंग आरएजी (Streaming RAG) में लेटेंसी बचत पर एक मॉडल-अज्ञेय (model-agnostic) सीमा स्थापित करने के लिए "टूल-इंटेंट स्टेबिलाइज़ेशन" (tool-intent stabilization) को अभिलक्षित करता है, जो यह प्रदर्शित करता है कि वास्तविक परिचालन स्थितियों के तहत, लगभग 74% क्वेरीज़ स्पेक्युलेटिव रिट्रीवल (speculative retrieval) को उपयोगकर्ता के बोलने समाप्त करने से पहले टूल लेटेंसी को प्रभावी ढंग से छिपाने की अनुमति देती हैं।

Elroy Galbraith2026-06-19
🤖 AI

Learning to Prompt: Improving Student Engagement with Adaptive LLM-based High-School Tutoring

यह शोध पत्र एक अनुकूली (adaptive) LLM-आधारित हाई-स्कूल ट्यूटरिंग सिस्टम प्रस्तुत करता है जो शिक्षण संबंधी विशेषताओं (pedagogical features) पर प्रशिक्षित एक विषय-जागरूक प्रॉम्प्ट रूटिंग मॉडल का उपयोग करता है ताकि सीखने की रणनीतियों के बीच गतिशील रूप से स्विच किया जा सके, जो सिमुलेशन से वास्तविक दुनिया के परिनियोजन (deployment) में सफलतापूर्वक स्थानांतरित होता है जहाँ यह स्थिर बेसलाइनों की तुलना में इंटरैक्शन टर्न्स को कम करता है और अभ्यास रूपांतरण दरों (exercise conversion rates) में महत्वपूर्ण सुधार करता है।

Po-Chin Chang, Nicholas Hogan, Aske Plaat, Michiel T. van der Meer2026-06-19
🤖 AI

Apparent Psychological Profiles of Large Language Models are Largely a Measurement Artifact

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) के स्पष्ट मनोवैज्ञानिक प्रोफाइल मुख्य रूप से दिशात्मक प्रतिक्रिया पूर्वाग्रह (directional response bias) द्वारा संचालित मापन संबंधी कृत्रिमताएं (measurement artifacts) हैं न कि वास्तविक गुण, जो प्रतिक्रिया ऑर्थोगोनैलिटी (response orthogonality) के लिए समर्पित समायोजनों के बिना LLMs का आकलन करने के लिए मानक मानव-निर्मित मनोवैज्ञानिक उपकरणों को अमान्य बना देते हैं।

Jelena Meyer, David Garcia, Dirk U. Wulff2026-06-19
💬 NLP

CzechDocs: A Multiway Parallel Dataset of Formatted Documents for Minority Languages in Czechia

यह शोध पत्र CzechDocs को प्रस्तुत करता है, जो चेक और अल्पसंख्यक भाषाओं में स्वरूपित (formatted) दस्तावेज़ों का एक मल्टीवे समानांतर डेटासेट है, जिसे उन मशीन अनुवाद प्रणालियों का मूल्यांकन करने और उन्हें उन्नत करने के लिए डिज़ाइन किया गया है जो दस्तावेज़ लेआउट को संरक्षित करने में सक्षम हैं।

Josef Jon, Ondřej Bojar2026-06-19