🤖 machine learning

Strategic Polysemy in AI Discourse: A Philosophical Analysis of Language, Hype, and Power

यह शोध पत्र यह तर्क देता है कि एआई (AI) विमर्श में बहुअर्थी शब्दों का रणनीतिक उपयोग, जिसे "ग्लोसलैटिंग" (glosslighting) कहा गया है, निवेश को बढ़ावा देने, सार्वजनिक धारणा को आकार देने और नैतिक जांच से बचने के लिए तकनीकी इनकार (technical deniability) बनाए रखते हुए मानवीकरण वाली भाषा की प्रेरक शक्ति का लाभ उठाता है।

Travis LaCroix, Fintan Mallory, Sasha Luccioni2026-04-24
💻 computer science

StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling

StyleVAR एक नियंत्रणीय इमेज स्टाइल ट्रांसफर विधि है जो विविध बेंचमार्क पर बनावट (टेक्सचर) को स्थानांतरित करते समय सिमेंटिक संरचना को संरक्षित करने में बेहतर प्रदर्शन प्राप्त करने के लिए ब्लेंडेड क्रॉस-अटेंशन मैकेनिज्म और दो-चरणीय प्रशिक्षण (सुपरवाइज्ड फाइन-ट्यूनिंग के बाद GRPO-आधारित रीइन्फोर्समेंट लर्निंग) के साथ विजुअल ऑटोरेग्रेसिव मॉडलिंग का लाभ उठाता है।

Liqi Jing, Dingming Zhang, Peinian Li, Lichen Zhu2026-04-24
💬 NLP

Serialisation Strategy Matters: How FHIR Data Format Affects LLM Medication Reconciliation

यह अध्ययन प्रदर्शित करता है कि FHIR डेटा सीरियलाइजेशन रणनीति लार्ज लैंग्वेज मॉडल्स में मेडिकेशन रिकॉन्सिलिएशन प्रदर्शन को महत्वपूर्ण रूप से प्रभावित करती है, जिसमें क्लिनिकल नैरेटिव फॉर्मेट 8B पैरामीटर्स तक के मॉडल्स के लिए परिणामों को अनुकूलित करता है जबकि रॉ JSON 70B मॉडल्स के लिए बेहतर हो जाता है, जो यह प्रकट करता है कि ओमिशन (चूक) प्रमुख विफलता मोड है और केवल डोमेन प्रीट्रेनिंग ही स्ट्रक्चर्ड एक्सट्रैक्शन के लिए पर्याप्त नहीं है।

Sanjoy Pator2026-04-24
💻 computer science

Behavioral Consistency and Transparency Analysis on Large Language Model API Gateways

यह शोधपत्र गेटस्कोप (GateScope) को प्रस्तुत करता है, जो एक ब्लैक-बॉक्स मापन ढांचा है जो कंटेंट, कन्वर्सेशन, बिलिंग और लेटेंसी आयामों के माध्यम से कमर्शियल एलएलएम (LLM) एपीआई गेटवे का ऑडिट करता है, जो विज्ञापित नीतियों और वास्तविक व्यवहारों जैसे कि साइलेंट मॉडल सब्स्टिट्यूशन, प्राइसिंग विचलन और असंगत प्रदर्शन के बीच महत्वपूर्ण विसंगतियों को उजागर करता है।

Guanjie Lin, Yinxin Wan, Shichao Pei, Ting Xu, Kuai Xu, Guoliang Xue2026-04-24
💻 computer science

Structural Quality Gaps in Practitioner AI Governance Prompts: An Empirical Study Using a Five-Principle Evaluation Framework

यह शोध पत्र कंप्यूटेबिलिटी थ्योरी (computability theory), प्रूफ़ थ्योरी (proof theory) और बेयसियन एपिस्टेमोलॉजी (Bayesian epistemology) पर आधारित एक पांच-सिद्धांत मूल्यांकन ढांचे को प्रस्तुत करता है, जो AI गवर्नेंस प्रॉम्प्ट्स की संरचनात्मक पूर्णता का आकलन करता है, और 34 GitHub फाइलों के एक अनुभवजन्य अध्ययन के माध्यम से यह प्रकट करता है कि 37% में डेटा वर्गीकरण और मूल्यांकन रूब्रिक्स जैसे महत्वपूर्ण तत्वों का अभाव है, जिससे AI-सहायता प्राप्त विकास में स्वचालित स्टैटिक एनालिसिस टूल्स की आवश्यकता पर बल मिलता है।

Christo Zietsman2026-04-24
💻 computer science

Mind the Prompt: Self-adaptive Generation of Task Plan Explanations via LLMs

यह शोध पत्र COMPASS को प्रस्तुत करता है, जो एक स्व-अनुकूलन योग्य (self-adaptive) ढांचा है जो जटिल साइबर-फिजिकल सिस्टम में एआई टास्क प्लानिंग के उच्च-गुणवत्ता वाले, मानव-समझने योग्य स्पष्टीकरण उत्पन्न करने के लिए प्रॉम्प्ट्स को स्वचालित रूप से संश्लेषित और परिष्कृत करने हेतु उपयोगकर्ता की संज्ञानात्मक अवस्थाओं और इंटरेक्शन संकेतों को एक POMDP के रूप में मॉडल करता है।

Gricel Vázquez, Alexandros Evangelidis, Sepeedeh Shahbeigi, Radu Calinescu, Simos Gerasimou2026-04-24
🤖 machine learning

TRAVELFRAUDBENCH: A Configurable Evaluation Framework for GNN Fraud Ring Detection in Travel Networks

यह शोध पत्र TravelFraudBench को प्रस्तुत करता है, जो तीन विशिष्ट फ्रॉड रिंग टोपोलॉजी वाले एक हेट्रोजेनियस ट्रैवल ग्राफ की विशेषता वाला एक कॉन्फ़िगर करने योग्य ओपन-सोर्स बेंचमार्क है, जो यह प्रदर्शित करता है कि ग्राफ न्यूरल नेटवर्क फ्रॉड रिंग्स का पता लगाने और उन्हें रिकवर करने में नॉन-ग्राफ बेसलाइन्स की तुलना में काफी बेहतर प्रदर्शन करते हैं और साथ ही डिवाइस और आईपी सह-अस्तित्व (co-occurrence) को महत्वपूर्ण संकेतों के रूप में रेखांकित करते हैं।

Bhavana Sajja2026-04-24
💬 NLP

Propensity Inference: Environmental Contributors to LLM Behaviour

यह शोध पत्र भाषा मॉडलों की अनधिकृत व्यवहार के प्रति प्रवृत्ति को मापने के लिए एक कठोर कार्यप्रणाली प्रस्तुत करता है, जिसे 23 मॉडलों पर लागू करते हुए यह प्रकट किया गया है कि रणनीतिक और गैर-रणनीतिक पर्यावरणीय कारक दोनों व्यवहारिक परिणामों में समान रूप से योगदान देते हैं और क्षमताओं में सुधार के साथ अधिक प्रभावशाली नहीं होते हैं, जबकि लक्ष्य संघर्षों के प्रति बढ़ती संवेदनशीलता को भी रेखांकित करते हैं।

Olli Järviniemi, Oliver Makins, Jacob Merizian, Robert Kirk, Ben Millwood2026-04-24
💻 computer science

Leveraging Multimodal LLMs for Built Environment and Housing Attribute Assessment from Street-View Imagery

यह शोध पत्र एक ऐसे नवीन ढांचे को प्रस्तुत करता है जो गूगल स्ट्रीट व्यू इमेजरी का उपयोग करके देश भर में इमारतों की स्थिति और आवास संबंधी विशेषताओं का स्वचालित और कुशलतापूर्वक मूल्यांकन करने के लिए फाइन-ट्यून्ड और डिस्टिल्ड मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे मानव रेटर्स के समान उच्च सटीकता प्राप्त होती है और साथ ही कंप्यूटिंग लागत और लेबलिंग प्रयास में उल्लेखनीय कमी आती है।

Siyuan Yao, Siavash Ghorbany, Kuangshi Ai, Arnav Cherukuthota, Meghan Forstchen, Alexis Korotasz, Matthew Sisk, Ming Hu (…)2026-04-24
💬 NLP

Cross-Session Threats in AI Agents: Benchmark, Evaluation, and Algorithms

यह शोधपत्र CSTM-Bench प्रस्तुत करता है, जो उन क्रॉस-सेशन AI एजेंट खतरों का पता लगाने के लिए एक डेटासेट और मूल्यांकन ढांचा है जो मेमोरीलेस गार्डरेल्स (memoryless guardrails) से बच निकलते हैं, यह प्रदर्शित करते हुए कि बाउंडेड-मेमोरी कोसेट रीडर्स (bounded-memory Coreset Readers), सेशन-बाउंड और फुल-लॉग अप्रोच दोनों से बेहतर प्रदर्शन करते हैं और एक नया मीट्रिक प्रस्तावित करते हैं जो डिटेक्शन रिकॉल को सर्विंग स्टेबिलिटी (serving stability) के साथ संतुलित करता है।

Ari Azarafrooz2026-04-24