💬 NLP

Label-Consistent Data Generation for Aspect-Based Sentiment Analysis Using LLM Agents

यह शोध पत्र एस्पेक्ट-बेस्ड सेंटीमेंट एनालिसिस (Aspect-Based Sentiment Analysis) के लिए एक एजेंटिक डेटा ऑग्मेंटेशन विधि प्रस्तावित करता है जो लेबल निरंतरता और डाउनस्ट्रीम टास्क प्रदर्शन में मानक प्रॉम्प्टिंग-आधारित जनरेशन से बेहतर प्रदर्शन करता है, विशेष रूप से T5-Base जैसे कम प्री-ट्रेन्ड मॉडल्स के लिए।

Mohammad H. A. Monfared, Lucie Flek, Akbar Karimi2026-02-19
💬 NLP

Training Models on Dialects of Translationese Shows How Lexical Diversity and Source-Target Syntactic Similarity Shape Learning

यह शोधपत्र यह प्रदर्शित करता है कि मशीन-अनुवादित डेटा पर छोटे अंग्रेजी भाषा के मॉडलों को प्रशिक्षित करने से पता चलता है कि जहाँ सामान्य पर्प्लेक्सिटी (perplexity) मुख्य रूप से अनुवादित कॉर्पस की शाब्दिक विविधता द्वारा संचालित होती है, वहीं व्याकरणिक प्रदर्शन स्रोत भाषा और अंग्रेजी के बीच टोपोलॉजिकल समानता से दृढ़ता से आकार लेता है।

Jenny Kunz2026-02-19
💬 NLP

Learning to Learn from Language Feedback with Social Meta-Learning

यह शोध पत्र सोशल मेटा-लर्निंग (SML) को प्रस्तुत करता है, जो एक फाइन-ट्यूनिंग पद्धति है जो बड़े भाषा मॉडलों को संवादात्मक फीडबैक को सक्रिय रूप से मांगने और उससे सीखने के लिए प्रशिक्षित करती है, जिससे वे विविध डोमेन में अस्पष्ट और कम-निर्दिष्ट कार्यों को अधिक प्रभावी ढंग से हल करने में सक्षम होते हैं।

Jonathan Cook, Diego Antognini, Martin Klissarov, Claudiu Musat, Edward Grefenstette2026-02-19
💬 NLP

From Growing to Looping: A Unified View of Iterative Computation in LLMs

यह शोध पत्र डेप्थ ग्रोथ (depth growth) और लेयर लूपिंग (layer looping) को एलएलएम (LLMs) में पुनरावृत्ति गणना (iterative computation) को प्रेरित करने के लिए पूरक विधियों के रूप में एकीकृत करता है, जो यह प्रदर्शित करता है कि वे अभिसारी यांत्रिक हस्ताक्षरों (convergent mechanistic signatures) को साझा करते हैं और तर्क क्षमताओं को महत्वपूर्ण रूप से बढ़ाने के लिए प्रभावी ढंग से संयोजित किए जा सकते हैं।

Ferdinand Kapl, Emmanouil Angelis, Kaitlin Maile, Johannes von Oswald, Stefan Bauer2026-02-19
💬 NLP

Optimizing Soft Prompt Tuning via Structural Evolution

यह शोध पत्र टोपोलॉजिकल सॉफ्ट प्रॉम्प्ट लॉस (TSLoss) का प्रस्ताव करता है, जो एक नवीन अनुकूलन विधि है जो सॉफ्ट प्रॉम्प्ट के संरचनात्मक विकास को मापने और निर्देशित करने के लिए पर्सिस्टेंट होमोलॉजी (persistent homology) का लाभ उठाती है, जिससे उनकी व्याख्यात्मकता, अभिसरण गति (convergence speed) और डाउनस्ट्रीम प्रदर्शन में वृद्धि होती है।

Zhenzhen Huang, Chaoning Zhang, Haoyu Bian, Songbo Zhang, Chi-lok Andy Tai, Jiaquan Zhang, Caiyan Qin, Jingjing Qu, Yala (…)2026-02-19
💬 NLP

CitiLink-Summ: Summarization of Discussion Subjects in European Portuguese Municipal Meeting Minutes

यह शोध पत्र CitiLink-Summ को प्रस्तुत करता है, जो इस डोमेन में स्वचालित सारांश (automatic summarization) के लिए डेटा की कमी को दूर करने और अत्याधुनिक जनरेटिव मॉडल्स एवं लार्ज लैंग्वेज मॉडल्स के लिए बेसलाइन प्रदर्शन स्थापित करने हेतु 2,322 हस्तनिर्मित सारांशों के साथ यूरोपीय पुर्तगाली नगर पालिका बैठक के कार्यवृत्त (municipal meeting minutes) का पहला कॉर्पस है।

Miguel Marques, Ana Luísa Fernandes, Ana Filipa Pacheco, Rute Rebouças, Inês Cantante, José Isidro, Luís Filipe Cunha, A (…)2026-02-19
💬 NLP

Quecto-V1: Empirical Analysis of 8-bit Quantized Small Language Models for On-Device Legal Retrieval

यह शोध पत्र Quecto-V1 को प्रस्तुत करता है, जो कि विशेष रूप से भारतीय कानूनों पर प्रशिक्षित और 8-बिट क्वांटाइजेशन के माध्यम से 150 MB से कम में संकुचित किया गया एक 124-मिलियन-पैरामीटर वाला लघु भाषा मॉडल (Small Language Model) है, जो यह प्रदर्शित करता है कि डोमेन-विशिष्ट, ऑफलाइन परिनियोजन डेटा संप्रभुता को बनाए रखते हुए और उच्च रिट्रीवल सटीकता बनाए रखते हुए कानूनी बुद्धिमत्ता का प्रभावी ढंग से लोकतंत्रीकरण कर सकता है।

Subrit Dikshit2026-02-19
⚡ electrical engineering

Scaling Open Discrete Audio Foundation Models with Interleaved Semantic, Acoustic, and Text Tokens

यह शोध पत्र SODA को प्रस्तुत करता है, जो नेटिव ऑडियो फाउंडेशन मॉडल्स का एक सुइट है जो सिमेंटिक, एकॉस्टिक और टेक्स्ट टोकन्स को संयुक्त रूप से मॉडल करता है, और विविध ऑडियो एवं क्रॉस-मोडल कार्यों में श्रेष्ठ प्रदर्शन प्रदर्शित करने के लिए 64 मॉडल्स के एक व्यापक अनुभवजन्य अध्ययन के माध्यम से एक प्रमाणित प्रशिक्षण रेसिपी और स्केलिंग लॉ स्थापित करता है।

Potsawee Manakul, Woody Haosheng Gan, Martijn Bartelds, Guangzhi Sun, William Held, Diyi Yang2026-02-19
💬 NLP

Reinforced Fast Weights with Next-Sequence Prediction

यह शोध पत्र REFINE को पेश करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो फास्ट वेट आर्किटेक्चर में नेक्स्ट-टोकन प्रेडिक्शन की सीमाओं को दूर करने के लिए नेक्स्ट-सीक्वेंस प्रेडिक्शन और ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन का उपयोग करता है, जिससे विभिन्न कार्यों में उनकी लॉन्ग-कॉन्टेक्स्ट मॉडलिंग क्षमताओं को महत्वपूर्ण रूप से बढ़ाता है।

Hee Seung Hwang, Xindi Wu, Sanghyuk Chun, Olga Russakovsky2026-02-19
💬 NLP

Differentiating Between Human-Written and AI-Generated Texts Using Automatically Extracted Linguistic Features

यह अन्वेषणात्मक अध्ययन स्वचालित भाषाई विश्लेषण का उपयोग यह प्रदर्शित करने के लिए करता है कि ChatGPT की मानवीय लेखन की नकल करने की क्षमता के बावजूद, एआई-जनित और मानव-लिखित ग्रंथों के बीच ध्वन्यात्मक, रूपात्मक, वाक्य-रचनात्मक और शाब्दिक विशेषताओं में महत्वपूर्ण मापने योग्य अंतर मौजूद हैं, जो बेहतर एआई प्रशिक्षण और स्वचालित मूल्यांकन उपकरणों की आवश्यकता को रेखांकित करते हैं।

Georgios P. Georgiou2026-02-18