💬 NLP

Domain-Adapted Small Language Models for Reliable Clinical Triage

यह अध्ययन प्रदर्शित करता है कि एक डोमेन-अनुकूलित, फाइन-ट्यून्ड ओपन-सोर्स स्मॉल लैंग्वेज मॉडल (Qwen2.5-7B), क्लिनिकल ट्राइएज नैरेटिव्स से इमरजेंसी सेवेरिटी इंडेक्स स्कोर को सटीक रूप से असाइन करने में बेसलाइन मॉडल्स और उन्नत प्रोप्रायटरी लार्ज लैंग्वेज मॉडल्स दोनों से काफी बेहतर प्रदर्शन करता है, जो आपातकालीन विभागों के लिए एक विश्वसनीय और गोपनीयता-संरक्षण निर्णय-सहायता उपकरण प्रदान करता है।

Manar Aljohani, Brandon Ho, Kenneth McKinley, Dennis Ren, Xuan Wang2026-04-30
🤖 AI

Bian Que: An Agentic Framework with Flexible Skill Arrangement for Online System Operations

बियांन क्यू (Bian Que) कुआईशौ (KuaiShou) के सर्च इंजन पर तैनात एक एजेंटिक फ्रेमवर्क है जो एक एकीकृत परिचालन प्रतिमान (unified operational paradigm), गतिशील डेटा और ज्ञान पुनर्प्राप्ति के लिए लचीली कौशल व्यवस्था और एक स्व-विकसित तंत्र पेश करके बड़े पैमाने पर सिस्टम संचालन में ऑर्केस्ट्रेशन बाधा को संबोधित करता है, जिससे अंततः अलर्ट की मात्रा में 75% की कमी आती है और औसत समाधान समय (mean time to resolution) में 50% से अधिक की कटौती होती है।

Bochao Liu, Zhipeng Qian, Yang Zhao, Xinyuan Jiang, Zihan Liang, Yufei Ma, Junpeng Zhuang, Ben Chen, Shuo Yang, Hongen W (…)2026-04-30
🤖 machine learning

Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data

यह शोध पत्र प्रदर्शित करता है कि यूनिफॉर्म-आधारित डिस्क्रीट डिफ्यूजन मॉडल (Uniform-based Discrete Diffusion Models) अनदेखे डेटा को पुनर्प्राप्त करने में सक्षम एसोसिएटिव मेमोरीज (associative memories) के रूप में कार्य करते हैं, जहाँ याद रखने (memorization) से सामान्यीकरण (generalization) की ओर संक्रमण प्रशिक्षण सेट के आकार द्वारा नियंत्रित होता है और इसे अनुमानित टोकन अनुक्रमों की कंडीशनल एंट्रॉपी (conditional entropy) के माध्यम से व्यावहारिक रूप से पहचाना जा सकता है।

Bao Pham, Mohammed J. Zaki, Luca Ambrogioni, Dmitry Krotov, Matteo Negri2026-04-30
🤖 AI

Resume-ing Control: (Mis)Perceptions of Agency Around GenAI Use in Recruiting Workflows

22 भर्ती पेशेवरों के साक्षात्कार के आधार पर, यह शोध पत्र प्रकट करता है कि जहाँ भर्तीकर्ता यह मानते हैं कि अंतिम अधिकार उनके पास है, वहीं जेनरेटिव एआई एक अदृश्य वास्तुकार बन गया है जो भर्ती कार्यप्रवाह और निर्णयों को आकार दे रहा है, जो अक्सर विकल्प के बजाय बाहरी दबावों से प्रेरित होता है, जिसके परिणामस्वरूप भर्तीकर्ताओं के कौशल ह्रास और समझौतापूर्ण निगरानी की उच्च लागत पर मामूली दक्षता लाभ प्राप्त होते हैं।

Sajel Surati, Rosanna Bellini, Emily Black2026-04-30
💬 NLP

Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models

यह शोध पत्र TIDE को प्रस्तुत करता है, जो डिफ्यूजन लार्ज लैंग्वेज मॉडल्स के क्रॉस-आर्किटेक्चर डिस्टिलेशन के लिए पहला फ्रेमवर्क है, जो विषम 8B और 16B शिक्षकों से 0.6B छात्र में सफलतापूर्वक ज्ञान स्थानांतरित करने के लिए तीन नवीन घटकों का उपयोग करता है, जो कोड जनरेशन जैसे बेंचमार्क में ऑटोरेग्रेसिव बेसलाइन से काफी बेहतर प्रदर्शन करता है।

Gongbo Zhang, Wen Wang, Ye Tian, Li Yuan2026-04-30
🤖 AI

Survey on reinforcement learning for language processing

यह लेख प्रासंगिक समस्याओं को रेखांकित करके, इन दृष्टिकोणों की उपयुक्तता और सीमाओं का विश्लेषण करके, और भविष्य की आशाजनक अनुसंधान दिशाओं का खाका खींचकर, मुख्य रूप से संवाद-आधारित प्रणालियों पर ध्यान केंद्रित करते हुए, प्राकृतिक भाषा प्रसंस्करण के लिए नवीनतम सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) विधियों का एक अवलोकन प्रदान करता है।

Victor Uc-Cetina, Nicolas Navarro-Guerrero, Anabel Martin-Gonzalez, Cornelius Weber, Stefan Wermter2026-04-29
🤖 AI

Visuo-Haptic Object Perception for Robots: An Overview

यह लेख मानव बहुविध धारणा के जैविक आधार का परीक्षण करके, संवेदी प्रौद्योगिकियों और गणनात्मक तकनीकों में प्रगति की समीक्षा करके, और वर्तमान चुनौतियों एवं भविष्य की अनुसंधान दिशाओं को रेखांकित करके, रोबोट में दृश्य-स्पर्श (visuo-haptic) वस्तु धारणा का एक व्यापक अवलोकन प्रदान करता है।

Nicolás Navarro-Guerrero, Sibel Toprak, Josip Josifovski, Lorenzo Jamone2026-04-29
🤖 machine learning

Quantifying the Effect of Feedback Frequency in Interactive Reinforcement Learning for Robotic Tasks

यह कार्य निरंतर स्थानों (continuous spaces) वाले रोबोटिक कार्यों के लिए संवादात्मक सुदृढीकरण शिक्षण (interactive reinforcement learning) में फीडबैक आवृत्ति के प्रभाव की जांच करता है और यह दर्शाता है कि कोई एकल इष्टतम आवृत्ति मौजूद नहीं है और एजेंट की बढ़ती दक्षता के अनुसार फीडबैक दरों को गतिशील रूप से अनुकूलित किया जाना चाहिए।

Daniel Harnack, Julie Pivin-Bachler, Nicolás Navarro-Guerrero2026-04-29
🤖 AI

Can-SAVE: Deploying Low-Cost and Population-Scale Cancer Screening via Survival Analysis Variables and EHR

Can-SAVE एक हल्का और स्केलेबल एआई सिस्टम है जो सर्वाइवल एनालिसिस और इलेक्ट्रॉनिक हेल्थ रिकॉर्ड्स का लाभ उठाकर कैंसर का पता लगाने की दरों और जनसंख्या कवरेज में पारंपरिक स्क्रीनिंग प्रोटोकॉल से काफी बेहतर प्रदर्शन करता है, जैसा कि रूस में 25 लाख से अधिक रोगियों पर व्यापक मूल्यांकन द्वारा प्रदर्शित किया गया है।

Petr Philonenko, Vladimir Kokh, Pavel Blinov2026-04-29
💬 NLP

TouchAI: Exploring human-AI perceptual alignment in touch through language model representations

यह शोध पत्र एक "गेस वॉट टेक्सटाइल" कार्य के माध्यम से बड़े भाषा मॉडलों और मानवीय स्पर्श अनुभवों के बीच संवेदी संरेखण की जांच करता है, जो यह प्रकट करता है कि हालांकि कुछ हद तक संरेखण मौजूद है, यह विभिन्न प्रकार के वस्त्रों में काफी भिन्न होता है और अक्सर मानवीय व्यक्तिपरक धारणाओं से मेल खाने में विफल रहता है।

Shu Zhong, Elia Gatti, Youngjun Cho, Marianna Obrist2026-04-29