🤖 AI

ARCO: Adaptive Rubric with Co-Evolution for Multi-Step LLM-Based Agents

यह शोध पत्र ARCO का प्रस्ताव करता है, जो एक साझा मॉडल बैकबोन के भीतर प्रति-चरण रूब्रिक मानदंडों के लिए एक जनरेशन हेड और चरण-स्तरीय पुरस्कारों के लिए एक स्कोरिंग हेड को सह-विकसित (co-evolves) करता है, जो चरण-स्तरीय लेबल या स्थिर क्लोज्ड-सोर्स जजों की आवश्यकता के बिना गतिशील क्रेडिट असाइनमेंट और बेहतर मल्टी-स्टेप एजेंट प्रदर्शन को सक्षम बनाता है।

Zihang Tian, Jingsen Zhang, Rui Li, Xiaohe Bo, Yuanzi Li, Xu Chen2026-06-23
💬 NLP

LISE : Listenable Interpretable Speaker Embeddings

यह शोध पत्र LISE को प्रस्तुत करता है, जो एक लेबल-मुक्त ढांचा है जो अपारदर्शी स्पीकर एम्बेडिंग्स को श्रव्य और व्याख्या योग्य घटकों के एक छोटे सेट में विभाजित करता है, जो स्वचालित वक्ता सत्यापन प्रदर्शन को सफलतापूर्वक बनाए रखते हुए मानव श्रोताओं को उच्च सटीकता के साथ वक्ताओं के बीच अंतर करने में सक्षम बनाता है।

Xiaoliang Wu, Chongxin Gan, Ke Liu, Peter Bell, Jennifer Williams2026-06-23
💬 NLP

Synthetic Audio Generation Framework for Air Traffic Control Speech Recognition

यह शोध पत्र एक सिंथेटिक ऑडियो जनरेशन फ्रेमवर्क प्रस्तावित करता है जो एयर ट्रैफिक कंट्रोल स्पीच रिकग्निशन के लिए प्रशिक्षण डेटा बनाने हेतु टेक्स्ट-टू-स्पीच, वॉयस कन्वर्जन और कंट्रोलेबल एक्सेंट सिमुलेशन जैसी न्यूरल तकनीकों को जोड़ता है, और यह प्रदर्शित करता है कि इस सिंथेटिक या मिश्रित डेटा के साथ ASR मॉडल को फाइन-ट्यून करने से बेसलाइन्स की तुलना में वर्ड एरर रेट में काफी कमी आती है।

Raphaël Bagat, Zhe Zhang, Junichi Yamagishi, Irina Illina, Emmanuel Vincent2026-06-23
⚡ electrical engineering

An Evaluation Framework for Text-to-Speech Voice Reconstruction

यह शोध पत्र टेक्स्ट-टू-स्पीच वॉयस पुनर्निर्माण के लिए एक व्यापक मूल्यांकन ढांचे का प्रस्ताव करता है जो पारंपरिक तरीकों की तुलना में बोधगम्यता (intelligibility) और वक्ता की पहचान (speaker identity) के बीच के संतुलन का अधिक विश्वसनीय रूप से मूल्यांकन करने के लिए व्यक्तिपरक मूल्यांकन हेतु 'बेस्ट वर्स्ट स्केलिंग' और वस्तुनिष्ठ विश्लेषण के लिए एक नवीन 'डुअल-रेफरेंस डिस्ट्रीब्यूशनल मेजर' को जोड़ता है।

Ariadna Sanchez, Christoph Minixhofer, Korin Richmond, Ondrej Klejch, Peter Bell, Simon King2026-06-23
💬 NLP

Factual Retrieval in LLMs Is a Redundant, Distributed and Non-Contiguous Process

यह शोध पत्र प्रकट करता है कि बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडेल्स) में तथ्यात्मक पुनर्प्राप्ति कई परतों में फैला हुआ, वितरित और गैर-सतत (नॉन-कंटीगुअस) कम्प्यूटेशनल पथों पर निर्भर करती है, जो स्थानीयकृत ज्ञान भंडारण की धारणा को चुनौती देती है और ज्ञान संपादन (नॉलेज एडिटिंग) में देखे गए बेमेल को स्पष्ट करती है।

Hail Hochman, Natalie Shapira, Yoav Goldberg2026-06-23
💬 NLP

Finetuning with Scientific Data Increases Hallucinations: A Multi-domain Factuality Evaluation of LLMs

यह शोधपत्र SciFactCheck प्रस्तुत करता है, जो एक बहु-डोमेन बेंचमार्क है जो यह प्रकट करता है कि वैज्ञानिक फाइन-ट्यूनिंग विरोधाभासी रूप से लार्ज लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) और आक्रामकता को बढ़ाती है जबकि उनके आंतरिक आत्मविश्वास को कम करती है, जिससे तथ्यपरकता में सुधार के लिए वर्तमान डोमेन-विशिष्ट फाइन-ट्यूनिंग दृष्टिकोणों को चुनौती मिलती है।

Raia Abu Ahmad, Nikolas Rauscher, Ekaterina Borisova, Fabio Barth, Georg Rehm, Sebastian Möller2026-06-23
⚡ electrical engineering

Sexualised synthetic personas encode and amplify gendered power asymmetries through voice

एक नारीवादी एचसीआई (HCI) परिप्रेक्ष्य का उपयोग करते हुए, यह अध्ययन प्रदर्शित करता है कि वाणिज्यिक एआई (AI) वॉयस सिस्टम लैंगिक शक्ति विषमताओं को इस प्रकार सुदृढ़ करते हैं कि महिला-कोडित आवाजों को कामुक और अधीन गुणों के साथ और पुरुष-कोडित आवाजों को प्रभुत्व एवं सकारात्मक गुणों के साथ जोड़ा जाता है।

Alice Ross, Ariadna Sanchez, Elin Kanhov, Catherine Lai, Eva Szekely2026-06-23
💬 NLP

Evaluation of Small Language Models for Arabic Language Processing

यह शोध पत्र दस कौशलों वाले एक नए 240-आइटम वाले अरबी बेंचमार्क पर बारह लघु भाषा मॉडलों (Small Language Models) का मूल्यांकन करता है, जिससे यह पता चलता है कि जेम्मा 3 (Gemma 3 - 12B) अन्य मॉडलों से बेहतर प्रदर्शन करता है और यह प्रदर्शित करता है कि मॉडल के आकार के बजाय अरबी संरेखण (Arabic alignment) और निर्देश-अनुसरण (instruction-following) क्षमताएं प्रदर्शन के अधिक महत्वपूर्ण निर्धारक हैं।

Jumana Alsubhi, Ahmed Alhusayni, Abdulrahman Gharawi, Israa Hamdine, Alshaymaa Allahim, Lamees Alhumaid, Ahmad Shabana (…)2026-06-23
💬 NLP

Economic Transformation and Cultural Change: Evidence from Two Centuries of French Drama

1700 से 1900 तक के 1,200 से अधिक फ्रांसीसी नाटकों के एक संग्रह पर कम्प्यूटेशनल भाषाविज्ञान, अर्थमिती और औपचारिक मॉडलिंग को संयोजित करते हुए, यह अध्ययन प्रदर्शित करता है कि कैसे फ्रांस के कुलीनतंत्र से पूंजीवाद में आर्थिक परिवर्तन ने राजनीतिक संप्रभुता से बुर्जुआ घरेलू अर्थशास्त्र की ओर साहित्यिक विषयों में एक मापने योग्य बदलाव को प्रेरित किया, जो सहकर्मी प्रभावों और आर्थिक झटकों के प्रति विकसित संवेदनशीलता द्वारा मध्यस्थता से संचालित था।

T. D. Oliveira, L. A. Attilio, M. J. Davila-Fernandez2026-06-23
💬 NLP

Towards Pedagogically Aligned LLM Tutors for Math Mistake Remediation

यह शोध पत्र एक दो-चरणीय संरेखण पाइपलाइन का प्रस्ताव करता है जो एक शैक्षणिक रूप से समृद्ध डेटासेट पर सुपरवाइज्ड फाइन-ट्यूनिंग और डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन को जोड़ता है ताकि ऐसे ओपन-सोर्स एलएलएम ट्यूटर्स बनाए जा सकें जो स्कैफोल्डिंग जैसी शैक्षणिक रणनीतियों का पालन करते हुए गणितीय गलतियों को प्रभावी ढंग से सुधारते हैं, और मालिकाना बेसलाइन के प्रतिस्पर्धी प्रदर्शन को प्राप्त करते हैं।

Kseniia Petukhova, Tien Dat Nguyen, Ekaterina Kochmar2026-06-23