🤖 machine learning

When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models

यह शोध पत्र वेरिएबल-साइज़ सेल्फ-कंटेन्ड ब्लॉक्स (VSB) का प्रस्ताव करता है, जो डिस्क्रीट डिफ्यूजन लैंग्वेज मॉडल्स के लिए एक ऐसी विधि है जो भविष्य के संदर्भ के साथ और उसके बिना की गई भविष्यवाणियों के बीच विचलन को मापकर इष्टतम डिकोडिंग ब्लॉक सीमाओं का चयन करती है ताकि भविष्यवाणात्मक निरंतरता सुनिश्चित की जा सके और समयपूर्व टोकन प्रतिबद्धता को रोका जा सके।

Danny Wang, Ruihong Qiu, Zi Huang2026-04-28
💻 computer science

From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills

यह शोध पत्र शेड्यूलिंग-स्ट्रक्चरल-लॉजिकल (SSL) प्रतिनिधित्व प्रस्तुत करता है, जो एजेंट कौशल के लिए एक नवीन संरचित ढांचा है जो शेड्यूलिंग, निष्पादन और तार्किक साक्ष्य को अलग करता है ताकि स्किल डिस्कवरी और रिस्क असेसमेंट कार्यों में टेक्स्ट-ओनली बेसलाइन्स की तुलना में काफी बेहतर प्रदर्शन किया जा सके।

Qiliang Liang, Hansi Wang, Zhong Liang, Yang Liu2026-04-28
💻 computer science

AgentPulse: A Continuous Multi-Signal Framework for Evaluating AI Agents in Deployment

एजेंटपल्स (AgentPulse) एक निरंतर, बहु-संकेत मूल्यांकन ढांचे को पेश करता है जो वास्तविक तैनाती परिदृश्यों में एआई एजेंटों के प्रदर्शन और प्रभाव का समग्र मूल्यांकन प्रदान करने के लिए एडॉप्शन (adoption), कम्युनिटी और इकोसिस्टम स्रोतों से रीयल-टाइम डेटा को एकत्रित करके स्टेटिक बेंचमार्क का पूरक बनता है।

Yuxuan Gao, Megan Wang, Yi Ling Yu2026-04-28
🔢 mathematics

Improving Robustness of Tabular Retrieval via Representational Stability

यह शोध पत्र यह पहचानता है कि विभिन्न टेबल सीरियलाइजेशन फॉर्मेट (जैसे CSV या HTML) असंगत रिट्रीवल परिणाम उत्पन्न करते हैं और सेंट्रॉइड-एवरेज्ड रिप्रेजेंटेशन और सिंगल-फॉर्मेट एम्बेडिंग्स को एक स्थिर, फॉर्मेट-इनवेरिएंट सिमेंटिक सिग्नल के साथ संरेखित करने के लिए एक लाइटवेट एडॉप्टर का उपयोग करके मजबूती में सुधार करने की एक विधि प्रस्तावित करता है।

Kushal Raj Bhandari, Adarsh Singh, Jianxi Gao, Soham Dan, Vivek Gupta2026-04-28
💻 computer science

Distilling Self-Consistency into Verbal Confidence: A Pre-Registered Negative Result and Post-Hoc Rescue on Gemma 3 4B

यह शोध पत्र रिपोर्ट करता है कि जहाँ Gemma 3 4B पर लेबल-एन्ट्रॉपी कोलैप्स (label-entropy collapse) के कारण सेल्फ-कंसिस्टेंसी (self-consistency) को वर्बल कॉन्फिडेंस (verbal confidence) में डिस्टिल करने का एक प्री-रजिस्टर्ड प्रयास विफल रहा, वहीं एक बाद के पोस्ट-हॉक रेस्क्यू ट्रेनिंग (post-hoc rescue training) ने अनफिल्टर्ड डेटा पर उच्च-सटीकता वाले सेल्फ-कंसिस्टेंसी सिग्नल्स को एक सिंगल-पास रीडआउट (single-pass readout) में सफलतापूर्वक संकुचित किया, जिसका AUROC2 0.774 था, जो यह प्रदर्शित करता है कि प्रभावी कॉन्फिडेंस कैलिब्रेशन के लिए लेबल एन्ट्रॉपी को बनाए रखना महत्वपूर्ण है।

Jon-Paul Cacioli2026-04-28
💻 computer science

How Sensitive Are Safety Benchmarks to Judge Configuration Choices?

यह शोध पत्र यह प्रदर्शित करता है कि LLM जजों का कॉन्फ़िगरेशन, विशेष रूप से प्रॉम्प्ट की शब्दावली, सुरक्षा बेंचमार्क में मापन विचलन (measurement variance) का एक पर्याप्त और पूर्व में कम जांचा गया स्रोत है, जो हानिकारक-प्रतिक्रिया दरों में महत्वपूर्ण बदलाव और मॉडल सुरक्षा रैंकिंग में अस्थिरता का कारण बनता है।

Xinran Zhang2026-04-28
💻 computer science

The Pragmatic Persona: Discovering LLM Persona through Bridging Inference

यह शोध पत्र अंतर्निहित ब्रिजिंग अनुमानों (bridging inferences) को संरचित ज्ञान ग्राफ के रूप में मॉडल करके लार्ज लैंग्वेज मॉडल व्यक्तित्वों (LLM personas) की खोज के लिए एक नवीन ढांचे का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि विमर्श-स्तरीय अर्थ संबंधी सुसंगतता (discourse-level semantic coherence), पारंपरिक सतही-स्तरीय शाब्दिक या शैलीगत संकेतों की तुलना में व्यक्तित्व पहचान के लिए अधिक सुदृढ़ और स्थिर आधार प्रदान करती है।

Jisoo Yang (Chung-Ang University), Jongwon Ryu (Chung-Ang University), Minuk Ma (University of British Columbia), Trung (…)2026-04-28
💻 computer science

Jailbreaking Frontier Foundation Models Through Intention Deception

यह शोध पत्र एक नवीन मल्टी-टर्न जेलब्रेकिंग तकनीक प्रस्तुत करता है जो फ्रंटियर मॉडल्स के "सेफ कंप्लीशन" प्रतिमान का लाभ उठाते हुए उन्हें हानिरहित दिखने वाले इरादों से धोखे में डालकर हानिकारक आउटपुट उत्पन्न करता है, साथ ही "पारा-जेलब्रेकिंग" नामक एक नव-खोजे गए भेद्यता वर्ग की पहचान और समाधान भी करता है।

Xinhe Wang, Katia Sycara, Yaqi Xie2026-04-28
💻 computer science

BiMol-Diff: A Unified Diffusion Framework for Molecular Generation and Captioning

BiMol-Diff एक एकीकृत डिफ्यूजन फ्रेमवर्क है जो संरचनात्मक रूप से सूचनात्मक उप-संरचनाओं को संरक्षित करके टेक्स्ट-कंडीशन्ड मॉलिक्यूलर जनरेशन और मॉलिक्यूल कैप्शनिंग दोनों में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए एक टोकन-अवेयर नॉइज़ शेड्यूल का उपयोग करता है, जिससे यह मानक डिफ्यूजन और ऑटोरेग्रेसिव मॉडलों की सीमाओं को दूर करता है।

Aditya Hemant Shahane, Anuj Kumar Sirohi, Devansh Arora, Nitin Kumar, Prathosh A P, Sandeep Kumar2026-04-28
💻 computer science

Factual and Edit-Sensitive Graph-to-Sequence Generation via Graph-Aware Adaptive Noising

यह शोध पत्र DLM4G को प्रस्तुत करता है, जो एक ग्राफ-जागरूक अनुकूली नॉइज़िंग डिफ्यूजन फ्रेमवर्क है जो ग्राफ संरचनाओं के अनुरूप एक अनुकूली डिनोइज़िंग रणनीति का उपयोग करके ग्राफ-टू-सीक्वेंस जनरेशन के लिए तथ्यात्मक ग्राउंडिंग और संपादन संवेदनशीलता में मौजूदा ऑटोरेग्रेसिव और डिफ्यूजन बेसलाइनों से काफी बेहतर प्रदर्शन करता है।

Aditya Hemant Shahane, Anuj Kumar Sirohi, Tanmoy Chakraborty, Prathosh A P, Sandeep Kumar2026-04-28