💬 NLP

lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation

यह शोध पत्र SemEval-2026 टास्क 1 (MWAHAHA) के लिए प्रथम स्थान प्राप्त करने वाले एक ऐसे सिस्टम को प्रस्तुत करता है जो "जनरेट-मेनी, सेलेक्ट-बेस्ट" रणनीति का उपयोग करके हास्य की श्रोता-निर्भर प्रकृति को संबोधित करता है, जहाँ उम्मीदवारों के एक विविध समूह को पूर्ण हास्य स्कोर के बजाय मानव युग्मवार निर्णयों (human pairwise judgments) पर प्रशिक्षित प्राथमिकता मॉडल द्वारा रैंक किया जाता है।

Alexey Tikhonov, Alexey Ivanov2026-06-02
💬 NLP

ART: Attention Run-time Termination for Efficient Large Language Model Decoding

यह शोध पत्र ART को प्रस्तुत करता है, जो एक हल्का रन-टाइम तंत्र है जो KV कैश एक्सेस को तब समाप्त कर देता है जब संचित अटेंशन आउटपुट नगण्य हो जाता है, जिससे सटीकता से समझौता किए बिना लार्ज लैंग्वेज मॉडल डिकोडिंग थ्रूपुट में 20% का सुधार होता है।

Chen Qiu, Guozhong Li, Panos Kalnis2026-06-02
💬 NLP

Cognitive-Linguistic Indicators of Depression in Online Communities: Analysed by DistilBERT and Holographic Reduced Representation

यह शोध पत्र प्रदर्शित करता है कि एक हाइब्रिड मॉडल, जो बेक के संज्ञानात्मक-भाषाई (cognitive-linguistic) लक्षणों को एनकोड करने वाले होलोग्राफिक रिड्यूस्ड रिप्रेजेंटेशन वेक्टर्स के साथ डिस्टिलबर्ट (DistilBERT) एम्बेडिंग्स को जोड़ता है, ऑनलाइन टेक्स्ट में अवसाद का पता लगाने में TF-IDF बेसलाइन की तुलना में काफी बेहतर प्रदर्शन करता है, जिससे 0.94 का मैक्रो F1 स्कोर प्राप्त होता है।

Brian Van Steen2026-06-02
💬 NLP

A Multi-Domain Red Teaming Framework for Safety, Robustness, and Fairness Evaluation of Medical Large Language Models

यह शोध पत्र एक बहु-डोमेन रेड टीमिंग फ्रेमवर्क प्रस्तुत करता है जो 690 नैदानिक रूप से आधारित परिदृश्यों में ग्यारह मेडिकल एलएलएम (LLMs) का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि शीर्ष मॉडल उच्च समग्र स्कोर प्राप्त करते हैं, फिर भी वे महत्वपूर्ण सुरक्षा विफलताओं और समानता संबंधी पूर्वाग्रहों को प्रदर्शित करते हैं जिनके लिए स्वचालन के साथ चिकित्सक की देखरेख को संयोजित करने वाले हाइब्रिड मूल्यांकन दृष्टिकोणों की आवश्यकता होती है।

Andrei Marian Feier, Veysel Kocaman, Yigit Gul, Ahmet Korkmaz, Alexander Thomas, Aleksei Zakharov, Jay Gil, Mehmet Butgu (…)2026-06-02
💬 NLP

TCAR-Gen: Temporal Graph Retrieval with Evidence Fusion for Knowledge-Grounded Generation

यह शोध पत्र TCAR-Gen का प्रस्ताव करता है, जो ऐतिहासिक आपराधिक मामलों के वृत्तांतों पर जटिल, समय-संवेदनशील प्रश्नों के लिए रिट्रीवल-ऑगमेंटेड जनरेशन को महत्वपूर्ण रूप से सुधारने हेतु क्वेरी-कंडीशन्ड ग्राफ न्यूरल नेटवर्क, टेम्पोरल एविडेंस फ्यूजन और चेन-ऑफ-ट्रीज़ रीजनिंग को एकीकृत करने वाला एक नवीन ढांचा है।

Sidra Nasir, Muhammad Noman Zahid, Rizwan Ahmed Khan2026-06-02
💬 NLP

LLMs for Cardiovascular Risk Prediction from Structured Clinical Data

यह शोध पत्र एक हाइब्रिड फ्रेमवर्क का प्रस्ताव करता है जो कोरोनरी आर्टरी डिजीज (कोरोनरी धमनी रोग) की भविष्यवाणी के लिए संरचित नैदानिक डेटा को प्राकृतिक भाषा के वृत्तांतों में परिवर्तित करता है, यह प्रदर्शित करते हुए कि जबकि रैंडम फॉरेस्ट जैसे पारंपरिक मॉडल उच्च सटीकता प्राप्त करते हैं, एलएलएम-आधारित दृष्टिकोण संवेदनशील संख्यात्मक डेटा को उजागर किए बिना रोगी विवरणों को संसाधित करके महत्वपूर्ण गोपनीयता लाभ प्रदान करते हैं।

Jeba Maliha, Md Rafiul Kabir2026-06-02
💬 NLP

The Invisible Coalition Partner: How LLMs Vote When Democracy Gets Concrete

अमूर्त प्रश्नावली में वामपंथी पूर्वाग्रह के पूर्व निष्कर्षों के विपरीत, यह अध्ययन प्रदर्शित करता है कि जब लार्ज लैंग्वेज मॉडल्स को ठोस स्विस जनमत संग्रहों का सामना कराया जाता है, तो वे मध्यमार्गी, यथास्थिति-पक्षपाती और भाषाई रूप से असंगत मतदान पैटर्न प्रदर्शित करते हैं जो उनके अमूर्त राजनीतिक प्रोफाइल से काफी भिन्न होते हैं।

Joel Barmettler2026-06-02
🤖 AI

Grokers: Bottom-Up Inductive Comprehension and Write-Time Intelligence over Typed Knowledge Graphs

यह शोध पत्र ग्रोकर्स (Grokers) को प्रस्तुत करता है, जो एक ऐसा आर्किटेक्चर है जो स्वायत्त एजेंटों का उपयोग करके टाइप किए गए नॉलेज ग्राफ्स का आगमनात्मक विश्लेषण और संवर्धन करके बुद्धिमत्ता को क्वेरी समय से राइट समय (write time) में स्थानांतरित करता है, जिससे निरंतर संरचित बोध, लगभग पूर्ण KV-कैश दक्षता और भविष्य के प्रश्नों के लिए शून्य अतिरिक्त लैंग्वेज मॉडल लागत प्राप्त होती है।

Gregory Magarshak2026-06-02
💬 NLP

Graph-Augmented Retrieval for Cross-Entity Financial Sentiment Analysis: A Comparative Study

यह शोध पत्र प्रदर्शित करता है कि एक नवीन टू-हॉप ग्राफ-आरएजी (Graph-RAG) आर्किटेक्चर, समग्र उत्तर गुणवत्ता से समझौता किए बिना जटिल संबंधपरक प्रश्नों के लिए एंटिटी रिकॉल और उत्तर प्रासंगिकता में सुधार करके, क्रॉस-एंटिटी वित्तीय भावना विश्लेषण में मानक वेक्टर-आधारित आरएजी (RAG) से काफी बेहतर प्रदर्शन करता है, जबकि परिशुद्धता और कवरेज के बीच संतुलन बनाने के लिए एक इष्टतम ग्राफ ट्रैवर्सल तीव्रता सीमा की पहचान करता है।

Rajan Bastakoti, Sagar Bhetwal, Nirajan Acharya, Gaurav Kumar Gupta2026-06-02
🔬 materials science

Beyond Text and Tables: Vision-Language Model Integration in ComProScanner for Extracting Materials Data from Scientific Figures with High Accuracy

यह शोध पत्र ComProScanner फ्रेमवर्क के एक उन्नत संस्करण को प्रस्तुत करता है जो वैज्ञानिक चित्रों से संरचना-गुण (composition-property) डेटा को स्वचालित रूप से निकालने के लिए विजन-लैंग्वेज मॉडल्स को एकीकृत करता है, जो उच्च सटीकता और लागत-प्रभावशीलता प्राप्त करते हुए टेक्स्ट, तालिकाओं और चित्रों से सामग्री डेटा खनन के लिए पहले पूर्णतः स्वचालित, मल्टीमॉडल पाइपलाइन को स्थापित करता है।

Aritra Roy, Enrico Grisan, Chiara Gattinoni, John Buckeridge2026-06-02