💻 computer science

Open-Domain Safety Policy Construction

यह शोध पत्र डीप पॉलिसी रिसर्च (DPR) को प्रस्तुत करता है, जो एक न्यूनतम एजेंटिक सिस्टम है जो वेब पर निरंतर खोज करने और नियमों को संकलित करने के माध्यम से बीज डोमेन जानकारी से व्यापक सामग्री मॉडरेशन नीतियां स्वायत्त रूप से तैयार करता है, जो विविध बेंचमार्क पर मौजूदा बेसलाइन से बेहतर प्रदर्शन और विशेषज्ञ द्वारा लिखित नीतियों के समकक्ष प्रदर्शन प्रदर्शित करता है।

Di Wu, Siyue Liu, Zixiang Ji, Ya-Liang Chang, Zhe-Yu Liu, Andrew Pleffer, Kai-Wei Chang2026-04-03
💻 computer science

Friends and Grandmothers in Silico: Localizing Entity Cells in Language Models

यह शोध पत्र भाषा मॉडलों की प्रारंभिक परतों में उन विरल (sparse), कारणत्मक रूप से कार्रवाई योग्य (causally actionable) MLP न्यूरॉन्स की पहचान और सत्यापन करता है जो विशिष्ट संस्थाओं (entities) को चुनिंदा रूप से एनकोड करते हैं, यह प्रदर्शित करते हुए कि इन स्थानीयकृत कोशिकाओं को सक्रिय करने से विशिष्ट संस्था-संबंधी तथ्यात्मक ज्ञान को विश्वसनीय रूप से प्राप्त किया जा सकता है और विभिन्न भाषाई रूपों में सुदृढ़ कैनोनिकलाइजेशन (canonicalization) का समर्थन किया जा सकता है।

Itay Yona, Dan Barzilay, Michael Karasik, Mor Geva2026-04-03
💻 computer science

Assessing Pause Thresholds for empirical Translation Process Research

यह शोध पत्र स्वचालित से चिंतनशील अनुवाद प्रक्रियाओं के बीच अंतर करने वाले विराम थ्रेशोल्ड (pause thresholds) निर्धारित करने के लिए तीन मौजूदा दृष्टिकोणों का मूल्यांकन करता है और प्रोडक्शन यूनिट ब्रेक्स (Production Unit Breaks) की गणना करने के लिए एक नवीन विधि प्रस्तावित करता है।

Devi Sri Bandaru, Michael Carl, Xinyue Ren2026-04-03
🤖 machine learning

Test-Time Scaling Makes Overtraining Compute-Optimal

यह शोध पत्र ट्रेन-टू-टेस्ट (T2T^2) स्केलिंग लॉज़ पेश करता है जो निश्चित बजट के तहत मॉडल आकार, प्रशिक्षण टोकन और अनुमान नमूनों (इन्फरेंस सैंपल्स) को संयुक्त रूप से अनुकूलित करते हैं, जो यह प्रकट करता है कि परीक्षण समय की लागत को ध्यान में रखने से इष्टतम प्रीट्रेनिंग रणनीतियाँ एक ओवरट्रेन्ड रिजीम की ओर स्थानांतरित हो जाती हैं जो मानक स्केलिंग दृष्टिकोणों की तुलना में काफी बेहतर प्रदर्शन करती हैं।

Nicholas Roberts, Sungjun Cho, Zhiqi Gao, Tzu-Heng Huang, Albert Wu, Gabriel Orlanski, Avi Trost, Kelly Buchanan, Aws Al (…)2026-04-03
💻 computer science

Adaptive Stopping for Multi-Turn LLM Reasoning

यह शोध पत्र MiCP को प्रस्तुत करता है, जो मल्टी-टर्न LLM रीजनिंग के लिए पहला कॉन्फॉर्मल प्रेडिक्शन फ्रेमवर्क है जो औपचारिक कवरेज गारंटी प्रदान करने के लिए टर्न्स के बीच एरर बजट आवंटित करता है और साथ ही उच्च-जोखिम वाले अनुप्रयोगों में लागत और विलंबता (लेटेंसी) को कम करने के लिए एडेप्टिव अर्ली स्टॉपिंग को सक्षम बनाता है।

Xiaofan Zhou, Huy Nguyen, Bo Yu, Chenxi Liu, Lu Cheng2026-04-03
💻 computer science

Cost-Efficient Estimation of General Abilities Across Benchmarks

यह शोध पत्र वाइड-स्केल आइटम लेवल डेटासेट (WILD) प्रस्तुत करता है और यह प्रदर्शित करता है कि एक संशोधित बहुआयामी आइटम रिस्पॉन्स थ्योरी मॉडल को लागत-जागरूक अनुकूलन योग्य आइटम चयन के साथ संयोजित करके, केवल 16 आइटम्स का उपयोग करके विविध अनदेखे कार्यों में LLM प्रदर्शन की उच्च सटीकता (7% से कम MAE) के साथ भविष्यवाणी की जा सकती है, जिससे मूल्यांकन लागत में 85% की कमी आती है।

Michael Krumdick, Adam Wiemerslage, Seth Ebner, Charles Lovering, Chris Tanner2026-04-03
💻 computer science

The power of context: Random Forest classification of near synonyms. A case study in Modern Hindi

यह अध्ययन प्रदर्शित करता है कि हिंदी वर्ड एम्बेडिंग्स पर प्रशिक्षित एक रैंडम फॉरेस्ट क्लासिफायर केवल संदर्भगत उपयोग पैटर्न के आधार पर संस्कृत और फारसी-अरबी पर्यायवाची शब्दों के बीच सफलतापूर्वक अंतर कर सकता है, जो इस बात का मात्रात्मक प्रमाण प्रदान करता है कि व्युत्पत्ति संबंधी मूल भाषा पर एक पता लगाने योग्य छाप छोड़ता है, भले ही शब्दों का अर्थ समान हो।

Jacek Bąkowski2026-04-03
💻 computer science

Wired for Overconfidence: A Mechanistic Perspective on Inflated Verbalized Confidence in LLMs

यह शोध पत्र एक सर्किट-स्तरीय यांत्रिक विश्लेषण प्रस्तुत करता है जो यह प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स में अत्यधिक मौखिक आत्मविश्वास (verbalized confidence) मध्य-से-विलंब परतों (middle-to-late layers) में स्थित एमएलपी ब्लॉक्स (MLP blocks) और अटेंशन हेड्स (attention heads) के एक संक्षिप्त सेट द्वारा संचालित होता है, जिन्हें इनफ्रेंस-टाइम पुनर्मानकन (inference-time recalibration) के लिए कारण-संबंधी रूप से पहचाना और लक्षित किया जा सकता है ताकि अंशांकन (calibration) में महत्वपूर्ण सुधार किया जा सके।

Tianyi Zhao, Yinhan He, Wendy Zheng, Yujie Zhang, Chen Chen2026-04-03
💻 computer science

From SWE-ZERO to SWE-HERO: Execution-free to Execution-based Fine-tuning for Software Engineering Agents

यह शोध पत्र SWE-ZERO से SWE-HERO को प्रस्तुत करता है, जो एक दो-चरणीय फाइन-ट्यूनिंग फ्रेमवर्क है जो बड़े पैमाने पर निष्पादन-मुक्त (execution-free) सिमेंटिक प्रशिक्षण को लक्षित निष्पादन-समर्थित (execution-backed) परिशोधन के साथ जोड़कर ओपन-वेट फ्रंटियर LLMs को अत्याधुनिक सॉफ्टवेयर इंजीनियरिंग एजेंटों में आसत (distill) करता है, जिससे SWE-bench Verified पर 62.2% रिज़ॉल्यूशन दर प्राप्त होती है और मजबूत बहुभाषी स्थानांतरणीयता (multilingual transferability) प्रदर्शित होती है।

Nikolai Ludwig, Wasi Uddin Ahmad, Somshubra Majumdar, Boris Ginsburg2026-04-03
💻 computer science

Magic, Madness, Heaven, Sin: LLM Output Diversity is Everything, Everywhere, All at Once

यह शोध पत्र एलएलएम (LLM) आउटपुट विविधता पर खंडित शोध को एकीकृत करने के लिए "मैजिक, मैडनेस, हेवन, सिन" (Magic, Madness, Heaven, Sin) ढांचे को प्रस्तुत करता है, जो चार मानक संदर्भों (ज्ञानमीमांसीय, संवादात्मक, सामाजिक और सुरक्षा) में एक समरूपता-विषमता अक्ष के साथ भिन्नता को मॉडल करता है, जिससे यह तर्क दिया जाता है कि विविधता का मूल्यांकन एक अंतर्निहित मॉडल विशेषता के बजाय एक कार्य-निर्भर गुण के रूप में किया जाना चाहिए।

Harnoor Dhingra2026-04-03