💻 computer science

LV-ROVER: Multi-Stream Tesseract Voting for Maltese Paragraph OCR

माल्टीज़ OCR के लिए वास्तविक दुनिया के प्रशिक्षण डेटा की कमी को दूर करने के लिए, लेखकों ने एक सिंथेटिक पाइपलाइन और एक मल्टी-स्ट्रीम टेसेरैक्ट वोटिंग एनसेम्बल (LV-ROVER) विकसित किया है जो एनसेम्बल रिकग्निशन और एक विशेष पोस्ट-प्रोसेसिंग चेन के संयोजन के माध्यम से 422-पैराग्राफ बेंचमार्क पर कैरेक्टर एरर रेट में 70% की कमी प्राप्त करता है।

Adam Darmanin2026-07-02
🤖 AI

SEFORA: Student Essays with Feedback Corpus and LLM Feedback Evaluation Framework

यह शोध पत्र SEFORA का परिचय देता है, जो वास्तविक प्रशिक्षक फीडबैक के साथ छात्र निबंधों का एक बड़े पैमाने पर कॉर्पस है, और UniMatch, जो एक नवीन मूल्यांकन ढांचा है जो यह प्रकट करता है कि वर्तमान LLMs मानव प्रशिक्षक की प्राथमिकताओं के अनुरूप फीडबैक उत्पन्न करने में संघर्ष करते हैं, जो व्यापक प्रयोगों में केवल 0.4 का अधिकतम F1 स्कोर प्राप्त करते हैं।

Shayan Peyghambari Oskoui, Norah Almousa, Zhaoyi Joey Hou, Carolina Gustafson, Gayle Rogers, Raquel Coelho, Diane Litman (…)2026-07-02
🤖 machine learning

Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds

यह शोध पत्र अपरिचित काउंटरफैक्चुअल (counterfactual) और ऐतिहासिक दुनियाओं में फ्रंटियर एलएलएम (LLM) के भौतिकी तर्क (physics reasoning) का मूल्यांकन करने के लिए एक ऑडिट करने योग्य चार-चरणीय नैदानिक ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि मॉडल आम तौर पर गुणात्मक प्रवृत्तियों को समझते हैं, वे अक्सर नए नियमों को मात्रात्मक रूप से लागू करने में विफल रहते हैं और आत्म-सुधार (self-correction) के साथ महत्वपूर्ण रूप से संघर्ष करते हैं।

Dong Zhang2026-07-02
🤖 machine learning

EPC: A Standardized Protocol for Measuring Evaluator Preference Dynamics in LLM Agent Systems

यह शोध पत्र EPC (इवैल्यूएटर प्रेफरेंस कपलिंग) को प्रस्तुत करता है, जो एक मानकीकृत, ओपन-सोर्स प्रोटोकॉल और वर्शन्ड रेफरेंस स्नैपशॉट है जिसे क्लोज्ड-लूप LLM एजेंट सिस्टम में इवैल्यूएटर बायस प्रोपेगेशन के पुनरुत्पादक मापन, क्रॉस-तुलना और क्षय का पता लगाने में सक्षम बनाने के लिए डिज़ाइन किया गया है।

Zewen Liu2026-07-02
🤖 machine learning

Mapping the Evaluation Frontier: An Empirical Survey of the Bias-Reliability Tradeoff Across Eleven Evaluator-Agent Conditions

यह शोध पत्र साक्ष्य आधार को पाँच से बढ़ाकर ग्यारह स्थितियों में विस्तारित करके LLM मूल्यांकन प्रणालियों में बायस-विश्वसनीयता (bias-reliability) के ट्रेडऑफ को अनुभवजन्य रूप से मान्य करता है, जो यह प्रदर्शित करता है कि इवैलुएटर कपलिंग, रणनीति विविधता और मापन विश्वसनीयता को एक साथ अनुकूलित नहीं किया जा सकता है और GPT-4o स्थितियों में वर्ज़न ड्रिफ्ट (version drift) के एक विशिष्ट पैटर्न को प्रकट करता है।

Zewen Liu2026-07-02
💻 computer science

A Text-Steerable Instrument for Sketching Procedural Soundscapes via Language Models

यह शोध पत्र एक वास्तविक समय के संगीत वाद्य यंत्र प्रस्तुत करता है जो प्राकृतिक-भाषा दृश्य विवरणों को एक श्रेणीबद्ध स्कीमा पर मानव-पठनीय कॉन्फ़िगरेशन उत्पन्न करके विकसित होते प्रक्रियात्मक ध्वनि-परिवेशों (साउंडस्केप्स) में परिवर्तित करता है, जिससे प्रदर्शनकारियों के लिए ऑडियो स्ट्रीम को बाधित किए बिना सीधे पैरामीटर समायोजन और बैकग्राउंड एलएलएम (LLM) अपडेट के माध्यम से ध्वनि को निर्देशित करना संभव हो जाता है।

Prabal Gupta (Rama Labs, Kitchener, Canada)2026-07-02
💻 computer science

When Classic Cache Policies Fail: Learning-Augmented Replacement for Semantic Retrieval Buffers

यह शोधपत्र SOLAR को प्रस्तुत करता है, जो एक लर्निंग-ऑगमेंटेड फ्रेमवर्क है जो क्लासिक कैश ह्यूरिस्टिक्स से बेहतर प्रदर्शन करता है और रिग्रेट-आधारित टाइमिंग और बेयसियन कंटेंट सिलेक्शन के माध्यम से उनकी अद्वितीय टेम्पोरल लोकैलिटी की कमी और निरंतर हिट क्वालिटी को संबोधित करके सिमेंटिक रिट्रीवल बफर्स के लिए एक कांस्टेंट कॉम्पिटिटिव रेश्यो प्राप्त करता है।

Yushi Sun, Bowen Cao, Wai Lam2026-07-02
🧬 biology

NeuroCogMap Reveals Cognitive Organization of Large Language Models

यह शोधपत्र NeuroCogMap को प्रस्तुत करता है, जो एक तंत्रिका विज्ञान-प्रेरित ढांचा (framework) है जो संज्ञानात्मक व्यवहारों की व्याख्या करने, मतिभ्रम (hallucinations) जैसे विफलता तंत्रों की पहचान करने और मानव कॉर्टिकल प्रतिक्रियाओं एवं निर्णय लेने की रणनीतियों के साथ मजबूत पत्राचार को प्रकट करने के लिए बड़े भाषा मॉडलों (LLMs) की आंतरिक विशेषताओं को कार्यात्मक पार्सल (functional parcels) में व्यवस्थित करता है।

Zhongxiang Sun, Haolang Lu, Qiang Ma, Qi Li, Qipeng Wang, Liang Pang, Chenyu Liu, Qiankun Li, Hao Sun, Kun Wang, Yi Zeng (…)2026-07-02
🤖 machine learning

A Mechanistic View of Authority Hierarchy in LLM Sycophancy

यह शोध पत्र प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स में अधिकार-प्रेरित चाटुकारिता केवल एक सतही पूर्वाग्रह नहीं है, बल्कि एक यांत्रिक घटना है जहाँ उच्च-स्तरीय अधिकार संकेत सही तथ्यात्मक निरूपणों के स्तर-स्थानीय विलोपन को ट्रिगर करते हैं, जो कथित विशेषज्ञता के प्रति क्रमिक सम्मान के साथ साक्ष्य को अधिग्रहित कर लेता है।

Emil Joswin, Srujananjali Medicherla, Priyanka Mary Mammen2026-07-02
⚡ electrical engineering

Speech Playground: An Interactive Tool for Speech Analysis and Comparison

यह शोधपत्र स्पीच प्लेग्राउंड (Speech Playground) को प्रस्तुत करता है, जो एक संवादात्मक वेब-आधारित टूल है जो अनुसंधान और उच्चारण प्रशिक्षण के लिए विविध प्रकार के फीचर्स, टेक्स्टग्रिड्स (TextGrids) और अलाइनमेंट सेटिंग्स के दृश्य और श्रव्य तुलना को सक्षम करके पारंपरिक स्पीच विश्लेषण सॉफ्टवेयर और आधुनिक डीप लर्निंग रिप्रेजेंटेशन्स के बीच के अंतर को पाटता है।

Stephen McIntosh, Daisuke Saito, Nobuaki Minematsu2026-07-02