💬 NLP

A Comparative Study of PyCaret AutoML and CNN-BiLSTM for Binary Hate Speech Detection in Indonesian Twitter

यह अध्ययन प्रदर्शित करता है कि एक CNN-BiLSTM मॉडल इंडोनेशियाई ट्विटर पर बाइनरी हेट स्पीच का पता लगाने में PyCaret AutoML के सर्वश्रेष्ठ पारंपरिक क्लासिफायर (रैंडम फॉरेस्ट) से बेहतर प्रदर्शन करता है, जो घने टोकन रिप्रजेंटेशन और द्विदिश संदर्भ का प्रभावी ढंग से लाभ उठाकर 6.6% अधिक सटीकता और 4.2% अधिक F1-स्कोर प्राप्त करता है।

Tanty Widiyastuti, Mayada, Adisty Syawalda Ariyanto, Luluk Muthoharoh, Ardika Satria, Martin Clinton Tosima Manullang2026-05-07
💬 NLP

BenCSSmark: Making the Social Sciences Count in LLM Research

यह स्थिति पत्र (position paper) तर्क देता है कि वर्तमान एलएलएम (LLM) बेंचमार्क में सामाजिक विज्ञान संबंधी कार्यों का कम प्रतिनिधित्व एआई (AI) की प्रगति और सामाजिक वैज्ञानिक जांच दोनों में बाधा डालता है, और एक नए "BenCSSmark" के परिचय का प्रस्ताव करता है—जो कम्प्यूटेशनल सामाजिक वैज्ञानिकों द्वारा एनोटेट किए गए डेटासेट से बना एक नया बेंचमार्क है—ताकि अधिक सुदृढ़, पारदर्शी और सामाजिक रूप से प्रासंगिक एआई प्रणालियाँ बनाई जा सकें।

Arnault Chatelain, Étienne Ollion, Qianwen Guan, Diandra Fabre, Lorraine Goeuriot, Emile Chapuis, Abdelkrim Beloued, Mar (…)2026-05-07
💬 NLP

Sentiment Analysis and Customer Satisfaction Prediction on E-Commerce Platforms Based on YouTube Comments Using the XGBoost Algorithm

यह अध्ययन इंडोनेशियाई ई-कॉमर्स से संबंधित यूट्यूब टिप्पणियों से ग्राहक संतुष्टि की भविष्यवाणी करने के लिए TF-IDF वेक्टरकरण और PyCaret के साथ अनुकूलित एक XGBoost एल्गोरिदम का उपयोग करता है, जो यह प्रकट करता है कि सामाजिक-राजनीतिक शब्दावली भावना ध्रुवीयता (sentiment polarity) को महत्वपूर्ण रूप से प्रभावित करती है।

Ridho Benedictus Togi Manik, Muhammad Aqil Ramadhan, Ihsan Maulana Yusuf, Luluk Muthoharoh, Ardika Satria, Martin Clinto (…)2026-05-07
💬 NLP

A Comparative Analysis of Machine Learning and Deep Learning Models for Tweet Sentiment Classification: A Case Study on the Sentiment140 Dataset

यह अध्ययन प्रदर्शित करता है कि एक पारंपरिक लॉजिस्टिक रिग्रेशन मॉडल, जो TF-IDF फीचर्स के साथ है, Sentiment140 डेटासेट के 10,000-ट्वीट के उपसमुच्चय पर सेंटीमेंट को वर्गीकृत करने में एक जटिल BiLSTM डीप लर्निंग आर्किटेक्चर से बेहतर प्रदर्शन करता है, जो ओवरफिटिंग से बचते हुए 69.17% के मुकाबले 73.5% सटीकता प्राप्त करता है, और इन परिणामों को एक इंटरैक्टिव Streamlit वेब एप्लिकेशन के माध्यम से तैनात किया गया है।

Vita Anggraini, Cintya Bella, Bastian, Luluk Muthoharoh, Ardika Satria, Martin C. T. Manullang2026-05-07
📊 statistics

Self-Attention as Transport: Limits of Symmetric Spectral Diagnostics

यह शोध पत्र सिद्ध करता है कि सममित स्पेक्ट्रल डायग्नोस्टिक्स (symmetric spectral diagnostics) मौलिक रूप से अटेंशन फ्लो (attention flow) की दिशा के प्रति ओरिएंटेशन-ब्लाइंड (orientation-blind) होते हैं, और एक बाइपार्टाइट-चीगर क्षमता मीट्रिक (bipartite-Cheeger capacity metric) तथा एक एसिमेट्री गुणांक (asymmetry coefficient) को संयोजित करने वाला एक द्वि-अक्षीय ढांचा प्रस्तुत करता है जो बड़े भाषा मॉडलों (large language models) में विशिष्ट विफलता मोड को सफलतापूर्वक अलग करने और भविष्यवाणी करने में सक्षम है।

Dominik Dahlem, Diego Maniloff, Mac Misiura2026-05-07
💬 NLP

Unintended Negative Impacts of Promotional Language in Patent Evaluation

2.7 मिलियन USPTO पेटेंट आवेदनों के इस बड़े पैमाने के अध्ययन से पता चलता है कि, विज्ञान में अपनी भूमिका के विपरीत, पेटेंट फाइलिंग में प्रचार संबंधी भाषा का उपयोग अनुदान, हस्तांतरण और सफल अपील की संभावना को काफी कम कर देता है, भले ही यह वस्तुनिष्ठ रूप से वास्तविक नवीनता और भविष्य के प्रभाव को दर्शाता हो, और यह "प्रचार दंड" महिला और नौसिखिया परीक्षकों के बीच अधिक स्पष्ट है।

Bingkun Zhao, Chenwei Zhang, Hao Peng2026-05-07
💬 NLP

UFAL-CUNI at SemEval-2026 Task 11: An Efficient Modular Neuro-symbolic Method for Syllogistic Reasoning

UFAL-CUNI टीम SemEval-2026 टास्क 11 के लिए एक कुशल मॉड्यूलर न्यूरो-सिम्बोलिक सिस्टम प्रस्तुत करती है जो सिलोगिस्टिक रीजनिंग (न्यायवाक्य तर्क) में प्रतिस्पर्धी सटीकता प्राप्त करने के लिए एक छोटे 4B-पैरामीटर वाले LLM पार्सर को एक सिम्बोलिक थ्योरम प्रूवर के साथ जोड़ती है और ज़ीरो-शॉट बेसलाइन से बेहतर प्रदर्शन करती है, हालांकि यह छोटे मॉडलों की बहुभाषी क्षमताओं में सीमाओं को रेखांकित करती है।

Ivan Kartáč, Kristýna Onderková, Jan Bronec, Zdeněk Kasner, Mateusz Lango, Ondřej Dušek2026-05-07
💬 NLP

Why Geometric Continuity Emerges in Deep Neural Networks: Residual Connections and Rotational Symmetry Breaking

यह लेख स्पष्ट करता है कि डीप न्यूरल नेटवर्क में ज्यामितिक निरंतरता (geometric continuity), रेसिडुअल कनेक्शनों, जो परतों के बीच भार अपडेट (weight updates) को संरेखित करते हैं, और सिमेट्री-ब्रेकिंग नॉनलिनियैरिटीज़ (symmetry-breaking nonlinearities), जो रोटेशनल ड्रिफ्ट को रोकने के लिए परतों को एक सामान्य समन्वय फ्रेम (common coordinate frame) तक सीमित करती हैं, के संयुक्त प्रभावों का परिणाम है।

Kyungwon Jeong, Won-Gi Paeng, Honggyo Suh2026-05-07
💬 NLP

Conceptors for Semantic Steering

यह शोधपत्र कॉन्सेप्टर्स (conceptors) को प्रस्तुत करता है, जो बड़े भाषा मॉडलों (large language models) को निर्देशित करने की एक ज्यामितीय रूप से सिद्धांत-आधारित विधि है, जो एकल-दिशात्मक सक्रियण वेक्टर (single-direction activation vectors) के स्थान पर पूर्ण बहुआयामी अवधारणा उप-स्थानों (multidimensional concept subspaces) को कैप्चर करने के लिए सॉफ्ट प्रोजेक्शन मैट्रिसेस (soft projection matrices) का उपयोग करता है, जिससे पारंपरिक योगात्मक बेसलाइनों (additive baselines) की तुलना में पैरामीटर-मुक्त लेयर चयन, बुलियन कंपोजिशनैलिटी (Boolean compositionality), और अधिक सुरक्षित एवं प्रभावी नियंत्रण सक्षम होता है।

Ilias Triantafyllopoulos, Young-Min Cho, Ren Tao, Miranda Muqing Miao, Sunny Rai, Lyle Ungar, Sharath Chandra Guntuku, N (…)2026-05-07
💬 NLP

Self-Induced Outcome Potential: Turn-Level Credit Assignment for Agents without Verifiers

यह शोधपत्र सेल्फ-इंड्यूस्ड आउटकम पोटेंशियल (SIOP) का प्रस्ताव करता है, जो एक नवीन फ्रेमवर्क है जो अंतिम उत्तरों को सिमेंटिक आउटकम मोड्स में क्लस्टर करके और उन मध्यवर्ती चरणों को पुरस्कृत करके लंबी अवधि के एलएलएम (LLM) एजेंटों के लिए टर्न-लेवल क्रेडिट असाइनमेंट को सक्षम बनाता है जो विश्वसनीय भविष्य की अवस्थाओं के लिए समर्थन बढ़ाते हैं, जिसमें बाहरी सत्यापनकर्ताओं या गोल्ड-आंसर पर्यवेक्षण की आवश्यकता नहीं होती है।

Senkang Hu, Yong Dai, Xudong Han, Zhengru Fang, Yuzhi Zhao, Sam Tak Wu Kwong, Yuguang Fang2026-05-07