💬 NLP

Timing is Everything: Temporal Scaffolding of Semantic Surprise in Humor

यह शोध पत्र ड्यूल प्रेडिक्शन वायलेशन (DPV) ढांचे को प्रस्तुत करता है और 828 चीनी स्टैंड-अप प्रदर्शनों का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि हास्य प्रशंसा (humor appreciation) की भविष्यवाणी करने में औसत अर्थ संबंधी विसंगति (average semantic incongruity) की तुलना में टेम्पोरल डायनेमिक्स, विशेष रूप से रणनीतिक विराम (strategic pauses) और चरम अर्थ संबंधी उल्लंघन (peak semantic violations), अधिक महत्वपूर्ण हैं, जिससे हास्य को एक टेम्पोरली स्कैफोल्डेड संज्ञानात्मक प्रक्रिया के रूप में पुनर्गठित किया गया है।

Yuxi Ma, Yongqian Peng, Junchen Lyu, Chi Zhang, Yixin Zhu2026-05-04
💬 NLP

RouteProfile: Elucidating the Design Space of LLM Profiles for Routing

यह शोध पत्र RouteProfile प्रस्तुत करता है, जो चार प्रमुख आयामों में संरचित LLM प्रोफाइल्स के लिए एक व्यापक डिज़ाइन स्पेस है, और व्यवस्थित मूल्यांकन के माध्यम से यह प्रदर्शित करता है कि संरचित, क्वेरी-स्तरीय प्रोफाइल्स विविध राउटर तंत्रों में रूटिंग प्रदर्शन और सामान्यीकरण को महत्वपूर्ण रूप से बढ़ाते हैं।

Jingjun Xu, Hongji Pu, Tao Feng, Haozhen Zhang, Jiaxuan You, Ge Liu2026-05-04
💬 NLP

Confidence Estimation in Automatic Short Answer Grading with LLMs

यह शोधपत्र एक हाइब्रिड कॉन्फिडेंस फ्रेमवर्क का प्रस्ताव करता है जो स्वचालित लघु उत्तर ग्रेडिंग के लिए मॉडल-आधारित संकेतों को डेटासेट-व्युत्पन्न एलेटोरिक अनिश्चितता (aleatoric uncertainty) के साथ जोड़ता है ताकि अधिक विश्वसनीय कॉन्फिडेंस अनुमान प्राप्त किए जा सकें और एकल-स्रोत दृष्टिकोणों की तुलना में चयनात्मक ग्रेडिंग प्रदर्शन में सुधार किया जा सके।

Longwei Cong, Sonja Hahn, Sebastian Gombert, Leon Camus, Hendrik Drachsler, Ulf Kroehne2026-05-04
💬 NLP

Persona-Grounded Safety Evaluation of AI Companions in Multi-Turn Conversations

यह शोध पत्र सुरक्षा जोखिमों का मूल्यांकन करने के लिए नैदानिक रूप से प्रमाणित व्यक्तित्वों (पर्सोना) का उपयोग करके एआई साथियों के साथ बहु-चरणीय अंतःक्रियाओं को सिम्युलेट करने के लिए एक स्केलेबल, एंड-टू-एंड फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि ऐप रेप्लिका (Replika) उच्च जोखिम वाले उपयोगकर्ता समूहों के साथ जुड़ते समय आत्म-हानि और हिंसा जैसी हानिकारक सामग्री को अक्सर सामान्य बना देता है।

Prerna Juneja, Lika Lomidze2026-05-04
💬 NLP

Estimating LLM Grading Ability and Response Difficulty in Automatic Short Answer Grading via Item Response Theory

यह शोध पत्र LLM-आधारित स्वचालित लघु उत्तर ग्रेडिंग का मूल्यांकन करने के लिए एक आइटम रिस्पांस थ्योरी (IRT) ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि समान समग्र स्कोर वाले मॉडल प्रतिक्रिया की कठिनाई बढ़ने के साथ विशिष्ट मजबूती प्रोफाइल प्रदर्शित करते हैं और उन विशिष्ट भाषाई एवं अर्थ संबंधी विशेषताओं की पहचान करता है जो ग्रेडिंग त्रुटियों के साथ सह-संबंधित हैं।

Longwei Cong, Sonja Hahn, Sebastian Gombert, Leon Camus, Hendrik Drachsler, Ulf Kroehne2026-05-04
⚡ electrical engineering

Alethia: A Foundational Encoder for Voice Deepfakes

यह शोध पत्र अलेथिया (Alethia) को प्रस्तुत करता है, जो एक नवीन फाउंडेशनल ऑडियो एनकोडर है जो बॉटलनेक मास्केड एम्बेडिंग प्रेडिक्शन (bottleneck masked embedding prediction) के साथ फ्लो-मैचिंग आधारित स्पेक्ट्रोग्राम रिकंस्ट्रक्शन (flow-matching based spectrogram reconstruction) के संयोजन वाले प्रीट्रेनिंग रेसिपी का उपयोग करके वॉयस डीपफेक डिटेक्शन और लोकलाइजेशन में मौजूदा स्पीच फाउंडेशन मॉडल्स से बेहतर प्रदर्शन करता है, जिससे विविध कार्यों और डोमेन में उत्कृष्ट मजबूती और ज़ीरो-शॉट जनरलाइजेशन प्राप्त होता है।

Yi Zhu, Brahmi Dwivedi, Jayaram Raghuram, Surya Koppisetti2026-05-04
💬 NLP

Retrieval-Augmented Reasoning for Chartered Accountancy

यह शोध पत्र CA-ThinkFlow को प्रस्तुत करता है, जो भारतीय चार्टर्ड अकाउंटेंसी में विश्वसनीयता की चुनौतियोंों को संबोधित करने के लिए एक क्वांटाइज्ड 14B रीजनिंग मॉडल और लेआउट-अवेयर डॉक्यूमेंट एक्सट्रैक्शन का उपयोग करने वाला एक पैरामीटर-एफिशिएंट रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है, जो CA-Ben बेंचमार्क पर शीर्ष प्रोप्रायटरी मॉडल्स के तुलनीय प्रदर्शन प्राप्त करता है, फिर भी कराधान (टैक्सेशन) में जटिल नियामक तर्क (रेगुलेटरी रीजनिंग) के साथ संघर्ष करता है।

Jatin Gupta, Akhil Sharma, Saransh Singhania, Ali Imam Abidi2026-05-04
💬 NLP

How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework

यह शोध पत्र प्रकट करता है कि भाषा मॉडलों के लिए मौजूदा व्हाइट-बॉक्स आउट-ऑफ-डिस्ट्रीब्यूशन (OOD) डिटेक्शन विधियाँ अनुक्रम लंबाई (sequence length) द्वारा संरचनात्मक रूप से भ्रमित होती हैं, और एक दो-मार्ग (two-pathway) ढांचे का प्रस्ताव करता है जो शब्दावली बदलावों (vocabulary shifts) के लिए एम्बेडिंग-आधारित संकेतों और जेलब्रेक जैसे गुप्त-इरादे वाले इनपुट का पता लगाने के लिए हिडन-स्टेट ट्रेजेक्टरी विशेषताओं के बीच अंतर करता है।

Hamidreza Saghir2026-05-04
💬 NLP

Are You the A-hole? A Fair, Multi-Perspective Ethical Reasoning Framework

यह शोध पत्र एक न्यूरो-सिंबोलिक ढांचे का प्रस्ताव करता है जो विरोधाभासी प्राकृतिक भाषा के निर्णयों को तार्किक रूप से सुसंगत नैतिक निर्णयों में एकत्रित करने के लिए भाषा मॉडलों को वेटेड मैक्सिमम सैटिस्फिएबिलिटी (MaxSAT) सॉल्वर के साथ जोड़ता है, जो r/AmItheAsshole डेटासेट पर मेजॉरिटी वोटिंग की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Sheza Munir, Ahanaf Rodoshi, Sumin Lee, Feiran Chang, Xujie Si, Syed Ishtiaque Ahmed2026-05-04
🤖 machine learning

Borrowed Geometry: Computational Reuse of Frozen Text-Pretrained Transformer Weights Across Modalities

यह शोध पत्र यह प्रदर्शित करता है कि फ्रोजन, टेक्स्ट-ओनली प्रीट्रेन गेम्मा 4 31B वेट्स को केवल एक पतले ट्रेन करने योग्य इंटरफेस का उपयोग करके रोबोटिक मैनिपुलेशन, निर्णय लेने और एसोसिएटिव रिकॉल कार्यों में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए प्रभावी रूप से विभिन्न मोडैलिटीज में स्थानांतरित किया जा सकता है, जो यह सिद्ध करता है कि मॉडल की प्रीट्रेनिंग लोड-बेयरिंग क्षमता उसके विशिष्ट मोडैलिटी या प्रशिक्षण डेटा के बजाय उसके वेट्स में अंतर्निहित है।

Abay Bektursun2026-05-04