📈 economics

Evaluating AI Investment Strategies

यह शोध पत्र संचयी पछतावे (cumulative regret) को लागत वैक्टर (cost vectors) और नीतिगत निर्णयों के बीच प्रति-अवधि सहप्रसरण (per-period covariances) में एक सटीक अपघटन (exact decomposition) स्थापित करता है, जो प्लेटफॉर्म तंत्र और पोर्टफोलियो प्रबंधन जैसे गतिशील वातावरणों में ब्लैक-बॉक्स एल्गोरिद्मिक रणनीतियोंों के मूल्यांकन के लिए एक सुलभ, मॉडल-मुक्त ऑडिट ढांचा प्रदान करता है।

Irene Aldridge2026-06-09
🤖 AI

Momentum for Reasoning: Dense Intrinsic Signals in Policy Optimization

यह शोध पत्र ISPO को प्रस्तुत करता है, जो एक नवीन पॉलिसी ऑप्टिमाइज़ेशन विधि है जो ज़ीरो-एडवांटेज कोलैप्स (Zero-Advantage Collapse) और हैलुसिनेटेड सर्टेन्टी (Hallucinated Certainty) को समाप्त करने के लिए पॉलिसी की अपनी संभावनाओं से प्राप्त इंट्रिन्सिक सिग्नल्स के साथ बाइनरी रिवार्ड्स को सघन बनाता है, जिससे चुनौतीपूर्ण गणितीय बेंचमार्क पर लार्ज लैंग्वेज मॉडल्स के लॉन्ग-चेन रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Hao Chen, Zhanming Shen, Liyao Li, Yanyu Chen, Xuhang Zhu, Xiaomeng Hu, Qi Zhang, Ru Peng, Xiaoyu Shen, Haobo Wang, Junb (…)2026-06-09
🤖 machine learning

Knowledge Graphs and Reasoning LLMs for Finding Simple Yet Effective Transcriptomic Perturbation Predictors

यह शोध पत्र प्रदर्शित करता है कि जैविक ज्ञान ग्राफ (biological knowledge graphs) का लाभ उठाने वाला एक सरल K-निकटतम पड़ोसी (K-nearest neighbor) दृष्टिकोण ट्रांसक्रिप्टोमिक व्यवधान प्रभावों (transcriptomic perturbation effects) की भविष्यवाणी करने में प्रतिस्पर्धी आउट-ऑफ-डिस्ट्रीब्यूशन प्रदर्शन प्राप्त करता है, जिसे पड़ोस चयन को परिष्कृत करने के लिए एक रीजनिंग LLM को अनुकूलित करने हेतु सुदृढीकरण लर्निंग (reinforcement learning) का उपयोग करके अत्याधुनिक तरीकों के बराबर बढ़ाया जा सकता है।

Jake Fawkes, Liam Hodgson, Jason Hartford2026-06-09
🤖 AI

Inference-Time Conformal Reasoning with Valid Factuality Control for Large Language Models

यह शोध पत्र इन्फरेंस-टाइम कॉन्फॉर्मल रीजनिंग (ITCR) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो वैध, संरचना-स्तरीय तथ्यात्मकता नियंत्रण प्रदान करने के लिए और पोस्ट-हॉक विधियों की तुलना में सटीकता में सुधार करने के लिए रीजनिंग ग्राफ के निर्माण में सीधे कॉन्फॉर्मल प्रेडिक्शन को एकीकृत करता है।

Ting Wang, Yuanjie Shi, Yan Yan, Huan Zhang2026-06-09
🤖 AI

Instrumental convergence and power-seeking

यह शोधपत्र तर्क देता है कि शक्ति-खोजने वाले कृत्रिम एजेंटों द्वारा उत्पन्न अस्तित्वगत जोखिम 'इंस्ट्रुमेंटल कन्वर्जेंस थिसिस' (साधन संबंधी अभिसरण सिद्धांत) के एक अत्यधिक सुदृढ़ संस्करण पर निर्भर करता है, जिसे वर्तमान बचाव सिद्ध करने में विफल रहे हैं, जिससे एआई सुरक्षा, दीर्घकालवाद (longtermism) और शासन से संबंधित प्रमुख मान्यताओं को चुनौती मिलती है।

David Thorstad2026-06-09
🤖 AI

Beyond Pass Rate: A Multilingual, Execution-Grounded Evaluation of Open Code LLMs

यह शोध पत्र 2,700 से अधिक लीटकोड (LeetCode) समस्याओं पर नौ ओपन कोड एलएलएम (LLMs) का एक बड़े पैमाने पर, बहुभाषी, निष्पादन-आधारित (execution-grounded) मूल्यांकन प्रस्तुत करता है, जो यह प्रकट करता है कि वर्तमान मॉडल मानव प्रदर्शन से काफी पीछे हैं और उनकी रैंकिंग एवं विफलता के स्वरूप विभिन्न भाषाओं और समस्या की कठिनाइयों के आधार पर काफी भिन्न होते हैं, जिससे एकल-मीट्रिक लीडरबोर्ड की सीमाओं पर प्रकाश पड़ता है।

Sayed Erfan Arefin2026-06-09
🤖 AI

Hybrid E-Assessment in Higher Education: Semi-Automated Grading of Paper-Based Written Examinations

यह शोध पत्र उच्च शिक्षा के लिए एक हाइब्रिड ई-असेसमेंट फ्रेमवर्क का प्रस्ताव करता है जो पूरी तरह से डिजिटल या पारंपरिक परीक्षा विधियों की सीमाओं को दूर करने के लिए संरचित हस्तलेखन पहचान (स्ट्रक्चर्ड हैंडराइटिंग रिकग्निशन) और विजन-सक्षम लार्ज लैंग्वेज मॉडल्स के माध्यम से अर्ध-स्वचालित ग्रेडिंग के साथ पेपर-आधारित समस्या-समाधान के शैक्षणिक लाभों को जोड़ता है।

Hartwig Grabowski, Michael Canz2026-06-09
🤖 machine learning

Cheap Reward Hacking Detection

यह शोध पत्र एक छोटे ट्रांसफार्मर एनकोडर का उपयोग करके टर्मिनल-रेंच (Terminal-Wrench) प्रक्षेपवक्रों में रिवॉर्ड हैकिंग का पता लगाने की एक लागत प्रभावी विधि प्रस्तुत करता है, जिसका प्रदर्शन एलएलएम-आधारित जजों के तुलनीय है लेकिन काफी कम कम्प्यूटेशनल लागत पर है, जो यह प्रदर्शित करता है कि मॉडल केवल व्यवहारिक पैटर्न के बजाय प्राकृतिक भाषा तर्क पर निर्भर करता है।

Iván Belenky, Joaquín Itria, Steven Johns2026-06-09
🤖 AI

Order Matters: Unveiling the Hidden Impact of Macro Placement Sequences via Proxy-Guided LLM Evolution

यह शोध पत्र OrderPlace प्रस्तुत करता है, जो एक प्रॉक्सी-निर्देशित (proxy-guided) LLM इवोल्यूशन फ्रेमवर्क है जो स्टेटिक ह्यूरिस्टिक्स की सीमाओं को दूर करने के लिए इष्टतम मैक्रो प्लेसमेंट अनुक्रमों (macro placement sequences) को स्वचालित रूप से खोजता है, जिससे ISPD 2005 बेंचमार्क पर अत्याधुनिक तरीकों की तुलना में वायरलेंथ में महत्वपूर्ण कमी आती है।

Shibing Mo, Jing Liu, Jianchu Xu, Ruilin Wu2026-06-09
🤖 AI

Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human

यह शोध पत्र तर्क देता है कि एलएलएम (LLM) एजेंटों के लिए मानवीय निरीक्षण एक संसाधन-आवंटन की समस्या है न कि एक सरल वर्गीकरण कार्य, जो मॉडलिंग और एक नई ओपन-सोर्स प्रणाली के माध्यम से यह प्रदर्शित करता है कि समीक्षक की थकान और व्यक्तिपरक असहमति एक उलटे-यू (inverted-U) सुरक्षा वक्र का निर्माण करती है जहाँ इष्टतम सुरक्षा के लिए फ्लडिंग हमलों को रोकने और मानवीय सीमाओं को ध्यान में रखते हुए एस्केलेशन दरों को 100% से नीचे कैलिब्रेट करना आवश्यक है।

Emre Turan2026-06-09