🤖 AI

RadAgent: A tool-using AI agent for stepwise interpretation of chest computed tomography

RadAgent एक टूल-उपयोग करने वाला AI एजेंट है जो एक व्याख्या योग्य, चरण-दर-चरण तर्क प्रक्रिया (reasoning trace) प्रदान करके चेस्ट CT रिपोर्ट जनरेशन को बेहतर बनाता है, जो मौजूदा 3D विजन-लैंग्वेज मॉडल्स की तुलना में नैदानिक सटीकता, मजबूती और निष्ठा में महत्वपूर्ण सुधार करता है।

Mélanie Roschewitz, Kenneth Styppa, Yitian Tao, Jiwoong Sohn, Jean-Benoit Delbrouck, Benjamin Gundersen, Nicolas Deperro (…)2026-06-02
🤖 AI

The Refusal--Compliance Tradeoff: A Large-Scale Safety Behavior Audit of Large Language Models

21 ओपन-वेट (open-weight) एलएलएम (LLM) के इस बड़े पैमाने के ऑडिट से पता चलता है कि सुरक्षा मीट्रिक के रूप में रिफ्यूज़ल रेट (refusal rate) पर निर्भरता दोषपूर्ण है क्योंकि इसमें ओवर-रिफ्यूज़ल (over-refusal) और हानिकारक अनुपालन (harmful compliance) के बीच महत्वपूर्ण ट्रेडऑफ मौजूद हैं, यह विकलांग व्यक्तियों की तुलना में प्रमुख समूहों के पक्ष में असमान जनसांख्यिकीय सुरक्षा को उजागर करता है, और यह प्रदर्शित करता है कि सुरक्षा व्यवहार मुख्य रूप से मॉडल आर्किटेक्चर के बजाय पोस्ट-ट्रेनिंग उद्देश्यों द्वारा आकार लेते हैं।

Alif Al Hasan, Sumon Biswas2026-06-02
🤖 AI

Position Paper: Post-Solve Robustness in Decision Engines: Feasible Regions and Smoothness Under Perturbations

यह शोध पत्र मिक्सड-इंटीजर लीनियर प्रोग्रामिंग निर्णय इंजनों के लिए एक नया "पोस्ट-सॉल्व रोबस्टनेस" (समाधान-पश्चात सुदृढ़ता) स्तर प्रस्तावित करता है जो वास्तविक दुनिया के पैरामीटर परिवर्तनों के विरुद्ध स्थिरता के लिए प्रमाणित, सॉल्वर-समर्थित साक्ष्य प्रदान करने हेतु व्यवहार्य पड़ोस (फिजिबल नेबरहुड्स) और समाधान की सुगमता (सॉल्यूशन स्मूथनेस) को औपचारिक रूप देकर नाममात्र के इष्टतम समाधानों का ऑडिट करता है।

Yi-Xiang Hu2026-06-02
🤖 AI

Optimal Transport-based Permutation-Invariant Bayesian Optimization of Offshore Wind Farm Layouts

यह शोध पत्र PIBO प्रस्तुत करता है, जो एक क्रम-अपरिवर्तनीय (permutation-invariant) बेयस अनुकूलन विधि है, जो टरबाइन प्लेसमेंट में समरूपता का लाभ उठाने के लिए ऑप्टिमल ट्रांसपोर्ट थ्योरी का उपयोग करके ऑफशोर विंड फार्म लेआउट को कुशलतापूर्वक अनुकूलित करती है, जिससे मानक दृष्टिकोणों की तुलना में काफी कम गणना समय के साथ बेहतर परिणाम प्राप्त होते हैं।

Antonio Candelieri, Laurens Bliek2026-06-02
🤖 AI

SortingHat: Redefining Operating Systems Education with a Tailored Digital Teaching Assistant

यह शोध पत्र SortingHat को प्रस्तुत करता है, जो एक AI-संचालित डिजिटल शिक्षण सहायक है जो चुनौतीपूर्ण ऑपरेटिंग सिस्टम पाठ्यक्रमों के लिए व्यक्तिगत, अनुकूलन योग्य और स्वचालित शैक्षिक सहायता प्रदान करने हेतु रिट्रीवल ऑगमेंटेड जनरेशन, मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग और एक 3D LLM इंटरफ़ेस का लाभ उठाता है।

Yifan Zhang, Xinkui Zhao, Zuxin Wang, Zhengyi Zhou, Guanjie Chen, Shuiguang Deng, Jianwei Yin2026-06-02
💬 NLP

AEyeDE: An Attention-Based Attribution Framework for AI-Generated Text Detection

यह शोध पत्र AEyeDE का प्रस्ताव करता है, जो एक व्याख्यात्मक ढांचा (interpretable framework) है जो एक प्रॉक्सी ट्रांसफॉर्मर मॉडल से अटेंशन-आधारित एट्रिब्यूशन मैप्स का लाभ उठाकर एआई-जनित टेक्स्ट का प्रभावी ढंग से पता लगाने के लिए एक हल्के वजन वाले CNN को इन संरचनात्मक संकेतों पर प्रशिक्षित करता है, जो विभिन्न सेटिंग्स और व्यवधानों (perturbations) में मजबूत प्रदर्शन प्रदर्शित करता है जहाँ पारंपरिक सतही-सांख्यिकीय (surface-statistic) विधियाँ संघर्ष करती हैं।

Aria Nourbakhsh, Adelaide Danilov, Christoph Schommer, Salima Lamsiyah2026-06-02
🤖 AI

Examine Clinicians' Modification of Hedging Language in Ambient AI Documentation: A Comparative Study of AI Drafts and Final Notes

यह अध्ययन 62,811 युग्मित एम्बिएंट एआई ड्राफ्ट और चिकित्सक-संपादित नोट्स का विश्लेषण करता है यह प्रकट करने के लिए कि चिकित्सक संशोधन के दौरान व्यवस्थित रूप से अधिक हेजिंग भाषा (संशयपूर्ण भाषा) पेश करते हैं और अधिक अनिश्चितता की ओर बढ़ते हैं, जिसमें विभिन्न एआई विक्रेताओं और नैदानिक विशिष्टताओं के बीच महत्वपूर्ण भिन्नताएं देखी गई हैं।

Yiliang Zhou, Yawen Guo, Di Hu, Sairam Sutari, Emilie Chow, Steven Tam, Danielle Perret, Deepti Pandita, Kai Zheng2026-06-02
🤖 AI

Understanding Stigmatizing Language in Clinical Documentation: A Paired Comparison of Ambient AI Drafts and Clinician Finalized Notes

यह अध्ययन प्रकट करता है कि जहाँ एम्बिएंट एआई (ambient AI) उपकरण क्लिनिकल ड्राफ्ट में कलंकपूर्ण भाषा उत्पन्न करते हैं, वहीं चिकित्सकों द्वारा की जाने वाली एडिटिंग अक्सर इस समस्या को और बढ़ा देती है क्योंकि वे हटाए गए शब्दों की तुलना में अधिक कलंकपूर्ण शब्द शामिल कर देते हैं, जिसके परिणामस्वरूप अंतिम इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड में पक्षपाती भाषा में शुद्ध वृद्धि होती है।

Yiliang Zhou, Yawen Guo, Sairam Sutari, Jasmine Dhillon, Alexandra L. Beck, Emilie Chow, Steven Tam, Danielle Perret, De (…)2026-06-02
💬 NLP

lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation

यह शोध पत्र SemEval-2026 टास्क 1 (MWAHAHA) के लिए प्रथम स्थान प्राप्त करने वाले एक ऐसे सिस्टम को प्रस्तुत करता है जो "जनरेट-मेनी, सेलेक्ट-बेस्ट" रणनीति का उपयोग करके हास्य की श्रोता-निर्भर प्रकृति को संबोधित करता है, जहाँ उम्मीदवारों के एक विविध समूह को पूर्ण हास्य स्कोर के बजाय मानव युग्मवार निर्णयों (human pairwise judgments) पर प्रशिक्षित प्राथमिकता मॉडल द्वारा रैंक किया जाता है।

Alexey Tikhonov, Alexey Ivanov2026-06-02
💬 NLP

A Multi-Domain Red Teaming Framework for Safety, Robustness, and Fairness Evaluation of Medical Large Language Models

यह शोध पत्र एक बहु-डोमेन रेड टीमिंग फ्रेमवर्क प्रस्तुत करता है जो 690 नैदानिक रूप से आधारित परिदृश्यों में ग्यारह मेडिकल एलएलएम (LLMs) का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि शीर्ष मॉडल उच्च समग्र स्कोर प्राप्त करते हैं, फिर भी वे महत्वपूर्ण सुरक्षा विफलताओं और समानता संबंधी पूर्वाग्रहों को प्रदर्शित करते हैं जिनके लिए स्वचालन के साथ चिकित्सक की देखरेख को संयोजित करने वाले हाइब्रिड मूल्यांकन दृष्टिकोणों की आवश्यकता होती है।

Andrei Marian Feier, Veysel Kocaman, Yigit Gul, Ahmet Korkmaz, Alexander Thomas, Aleksei Zakharov, Jay Gil, Mehmet Butgu (…)2026-06-02