💬 NLP

FirstPass: Grounding AI Scientific Judgment in Multi-Round Editorial Outcomes

यह शोध पत्र FirstPass प्रस्तुत करता है, जो Nature Communications के 3,668 बहु-चरणीय सहकर्मी-समीक्षा (पीयर-रिव्यू) संवादों पर निर्मित एक डेटासेट और फाइन-ट्यून किया गया मॉडल है, जो रिस्पॉन्स-ओनली लॉस मास्किंग और पांच वैज्ञानिक डोमेनों में पारदर्शी, पुनरावृत्ति संवाद डेटा का लाभ उठाकर संपादकीय परिणामों की भविष्यवाणी करने और वैज्ञानिक समीक्षाएं उत्पन्न करने में मौजूदा एआई प्रणालियों से काफी बेहतर प्रदर्शन करता है।

Prabhjot Singh, Somnath Luitel, Manmeet Singh, Josh Durkee2026-06-23
💬 NLP

Beyond 'One Language, One Script': Quantifying Orthographic Bias in Multilingual VLMs with PuMVR

यह शोध पत्र PuMVR प्रस्तुत करता है, जो बहुभाषी विजन-लैंग्वेज मॉडल्स में महत्वपूर्ण ऑर्थोग्राफिक पूर्वाग्रह को मापने वाला पहला बेंचमार्क है, यह प्रदर्शित करते हुए कि ये सिस्टम पंजाबी की तीन सक्रिय लिपियों (गुरमुखी, शाहमुखी और रोमन) के बीच प्रदर्शन में भारी अंतर और असंगत तर्क प्रदर्शित करते हैं, जिससे इस धारणा को चुनौती मिलती है कि एक भाषा का अर्थ एक एकल लेखन प्रणाली है।

Prabhjot Singh, Bhushan Pawar, Madhu Reddiboina2026-06-23
💬 NLP

PeerCheck: Enhancing LLM-Generated Academic Reviews Towards Human-Level Quality

पियरचेक (PeerCheck) फ्रेमवर्क मानव और एलएलएम (LLM) द्वारा जनरेट किए गए फीडबैक के बीच के अंतरों का विश्लेषण करके उच्च गुणवत्ता वाले शैक्षणिक सहकर्मी समीक्षाओं (academic peer reviews) की बढ़ती आवश्यकता को संबोधित करता है और यह प्रदर्शित करता है कि जबकि चेन-ऑफ-थॉट (Chain-of-Thought) प्रॉम्प्टिंग समीक्षा की गुणवत्ता को महत्वपूर्ण रूप से बढ़ाती है, रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) उपयोग किए गए मॉडल के आधार पर अप्रत्याशित रूप से इसे कम कर सकता है।

Zeyuan Chen, Ziqing Yang, Yihan Ma, Michael Backes, Yang Zhang2026-06-23
💬 NLP

Storyline Trees: Hierarchical Representations for Long-Form Narratives

यह शोध पत्र "स्टोरीलाइन ट्रीज़" (storyline trees) को प्रस्तुत करता है, जो एक पदानुक्रमित प्रतिनिधित्व है जो लंबी कथाओं को दृश्यों और कथानकों के बहु-स्तरीय संरचनाओं में व्यवस्थित करता है ताकि अनुकूलन योग्य पुनर्प्राप्ति (adaptive retrieval) सक्षम हो सके, जो मौजूदा लॉन्ग-कॉन्टेक्स्ट मॉडल्स और चंक-आधारित विधियों की तुलना में प्रश्न-उत्तर प्रदर्शन में महत्वपूर्ण सुधार करता है।

Litu Ou, Mirella Lapata2026-06-23
💬 NLP

Comparing Transformers and Hybrid Models at the Token Level

यह शोध पत्र Olmo 3 और Olmo Hybrid का उपयोग करके शुद्ध ट्रांसफॉर्मर और हाइब्रिड लैंग्वेज मॉडल्स के बीच टोकन-स्तरीय प्रदर्शन अंतर का विश्लेषण करता है, जो यह प्रकट करता है कि हाइब्रिड मॉडल्स रिकरेंट लेयर्स के माध्यम से सिमेंटिक कंटेंट (अर्थगत सामग्री) की भविष्यवाणी करने और स्टेट को ट्रैक करने में उत्कृष्ट हैं, जबकि ट्रांसफॉर्मर्स सिंटैक्टिक ब्रैकेट मैचिंग और nn-ग्राम कॉपी करने वाले कार्यों पर बेहतर प्रदर्शन करते हैं।

Yanhong Li, William Merrill2026-06-23
💬 NLP

Scaling Diverse Language Generation for 3D Visual Grounding

यह शोध पत्र ViGiL3D++ का प्रस्ताव करता है, जो एक स्केलेबल (scalable), सीन-एग्नोस्टिक (scene-agnostic) विधि है जो विविध 3D विजुअल ग्राउंडिंग क्वेरीज़ उत्पन्न करने के लिए सीन ग्राफ कंस्ट्रेंट सैंपलिंग और लार्ज लैंग्वेज मॉडल्स का लाभ उठाती है, जिससे मौजूदा डेटासेट्स की सीमाओं को दूर किया जा सके और कई बेंचमार्क पर मॉडल के प्रदर्शन में सुधार किया जा सके।

Austin T. Wang, Dongchen Yang, Angel X. Chang2026-06-23
💬 NLP

Learning What Not to Forget: Long-Horizon Agent Memory from a Few Kilobytes of Learning

यह शोध पत्र LRE (लर्नड रिलेवेंस इविक्शन) को प्रस्तुत करता है, जो एक हल्का, केवल CPU-आधारित, भाषा-मॉडल-मुक्त स्कोरर है जो लंबे समय तक चलने वाले एजेंटों के लिए महत्वपूर्ण इंटरैक्शन इतिहास की पहचान करने और उसे बनाए रखने के लिए सीखता है, जो न्यूनतम कम्प्यूटेशनल लागत और एनोटेशन-मुक्त प्रशिक्षण के साथ काम करते हुए मौजूदा बेसलाइन की तुलना में बेहतर सटीकता और दक्षता प्राप्त करता है।

Nusrat Jahan Lia, Aritra Mazumder2026-06-23
🤖 machine learning

Right Knowledge, Wrong Answer: Test-Time Steering for Temporal Fact Conflicts in Open-Weight Language Models

यह शोध पत्र टेम्पोरल अट्रैक्टर स्टीयरिंग (TAS) को प्रस्तुत करता है, जो एक टेस्ट-टाइम हस्तक्षेप विधि है जो ओपन-वेट लैंग्वेज मॉडल्स में पैरामीट्रिक टेम्पोरल संघर्षों का पता लगाती है और उन्हें हल करती है, जो हिडन स्टेट्स को नए तथ्यों की ओर निर्देशित करके बिना रिट्रेनिंग या बाहरी रिट्रीवल के महत्वपूर्ण उत्तर सुधार दर प्राप्त करती है।

Elias Hossain, Sourav Saha, Umesh Chandra Biswas, Sanjeda Sara Jennifer2026-06-23
💬 NLP

Phonemes to the Rescue: Multilingual Tokenization Based on International Phonetic Alphabet

यह शोध पत्र विभिन्न भाषाओं के बीच प्रदर्शन की असमानताओं को दूर करने के लिए बहुभाषी टोकनाइज़र हेतु भाषा-निरपेक्ष इनपुट के रूप में अंतर्राष्ट्रीय ध्वन्यात्मक वर्णमाला (IPA) का उपयोग करने का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि IPA-आधारित टोकनाइज़ेशन गुणवत्ता और सामान्यीकरण में सुधार करता है, विशेष रूप से गैर-लैटिन लिपियों के लिए।

Milan Miletić, Julie Kallini, Ekaterina Shutova2026-06-23
🤖 AI

Building Agent Harnesses for Scientific Curation from Multimodal Sources

यह शोध पत्र बीवर (Beaver) को प्रस्तुत करता है, जो एक एजेंट हार्नेस है जिसे फ्रंटियर एजेंट्स को टास्क स्कैफोल्डिंग, मल्टीमॉडल एविडेंस टूलिंग और प्रोवेनेंस ट्रैकिंग के साथ एकीकृत करके मल्टीमॉडल स्रोतों से वैज्ञानिक क्यूरेशन में सुधार करने के लिए डिज़ाइन किया गया है, ताकि 81.0 GRAS स्कोर प्राप्त किया जा सके, जो संरचित डेटा निष्कर्षण के ऑडिट योग्य, पुनरावृत्त परिशोधन को सक्षम करके मौजूदा एजेंट्स से काफी बेहतर प्रदर्शन करता है।

Sheng Zhang, Qin Liu, Renqian Luo, Shufang Xie, Reuben Tan, Sean Hayes, Gregory Bryman, Wendong Ge, Roxy Zhang, Oluwaseu (…)2026-06-23