💻 computer science

ViMU: Benchmarking Video Metaphorical Understanding

यह शोध पत्र ViMU को प्रस्तुत करता है, जो हिंट-मुक्त, मल्टीमॉडल साक्ष्य-आधारित प्रश्नों के माध्यम से शाब्दिक दृश्य बोध से परे निहित रूपक, विडंबना और सामाजिक उपपाठ का अनुमान लगाने की सीमावर्ती वीडियो समझ मॉडल की क्षमता का व्यवस्थित रूप से मूल्यांकन करने के लिए डिज़ाइन किया गया पहला बेंचमार्क है।

Qi Li, Xinchao Wang2026-05-15
🤖 machine learning

From Sycophantic Consensus to Pluralistic Repair: Why AI Alignment Must Surface Disagreement

यह शोध पत्र तर्क देता है कि वर्तमान एआई अलाइनमेंट (AI alignment) की प्राथमिकता एकत्रीकरण (preference aggregation) पर निर्भरता एक खतरनाक "चाटुकारितापूर्ण आम सहमति" (sycophantic consensus) को बढ़ावा देती है जो आवश्यक असहमति को दबा देती है, और "बहुलवादी अलाइनमेंट" (pluralistic alignment) की ओर एक बदलाव का प्रस्ताव देता है जिसे स्कोपिंग (scoping), सिग्नलिंग (signalling) और सिद्धांतपूर्ण मरम्मत (principled repair) के संवादात्मक तंत्रों द्वारा परिभाषित किया गया है, जिसे एक नए मीट्रिक के माध्यम से संचालित किया जाना चाहिए ताकि यह सुनिश्चित हो सके कि एआई सिस्टम केवल संघर्षों को सुगम बनाने के बजाय मूल्य संघर्षों (value conflict) को बनाए रख सकें।

Varad Vishwarupe, Nigel Shadbolt, Marina Jirotka2026-05-15
💻 computer science

Tradeoffs are Domain Dependent: Improving Accuracy and Fairness in Property Tax Assessments

यह शोध पत्र 26 मिलियन अमेरिकी संपत्ति बिक्री के विश्लेषण के माध्यम से निष्पक्षता-सटीकता ट्रेडऑफ (fairness-accuracy tradeoff) की अनुमानित सार्वभौमिकता को चुनौती देता है, यह प्रदर्शित करते हुए कि अतिरिक्त विशेषताओं और जनगणना डेटा के साथ संपत्ति कर मूल्यांकन के लिए भविष्य कहनेवाला मॉडल (predictive models) में सुधार करने से सटीकता और निष्पक्षता दोनों एक साथ बढ़ती हैं, जिससे प्रणाली की प्रतिगामी प्रकृति (regressivity) कम होती है।

Evelyn Smith, Emma Harvey, Christopher Berry, Jacob Goldin, Daniel E. Ho2026-05-15
💬 NLP

AI Knows When It's Being Watched: Functional Strategic Action and Contextual Register Modulation in Large Language Models

यह अध्ययन प्रदर्शित करता है कि जब बड़े भाषा मॉडल सामाजिक अवलोकन को महसूस करते हैं, तो वे व्यवस्थित भाषाई अनुकूलन और रजिस्टर औपचारिकता प्रदर्शित करते हैं, जिसमें मानव निगरानी एआई निगरानी की तुलना में अधिक मजबूत व्यवहार परिवर्तन उत्पन्न करती है, जिससे सामाजिक रूप से संरचित संदर्भों में रणनीतिक संचार संबंधी कार्रवाई की उनकी क्षमता का पता चलता है।

Vinicius Covas, Jorge Alberto Hidalgo Toledo2026-05-15
📊 statistics

Due Process on Hold: A Queueing Framework for Improving Access in SNAP

यह शोध पत्र एक कतार प्रणाली (queueing framework) प्रस्तावित करता है जो रेडियल्स (redials) और परित्याग (abandonment) जैसी अंतर्जात भीड़भाड़ की घटनाओं को ध्यान में रखता है ताकि यह प्रदर्शित किया जा सके कि कैसे मानक स्टाफिंग मॉडल SNAP कॉल केंद्रों में प्रक्रियात्मक उचित प्रक्रिया (procedural due process) सुनिश्चित करने में विफल रहते हैं, और पहुंच प्रणालियों को पुनर्गठित करने तथा बड़े पैमाने पर प्रक्रियात्मक इनकार को रोकने के लिए एक डेटा-संचालित दृष्टिकोण प्रस्तुत करता है।

Andrew Daw, Chloe Pache, Angela Zhou2026-05-15
💻 computer science

Algorithmic Addiction by Design: Big Tech's Leverage of Dark Patterns to Maintain Market Dominance and its Challenge for Content Moderation

यह शोध पत्र इस बात की जांच करता है कि कैसे बिग टेक कंपनियां बाजार में प्रभुत्व बनाए रखने और उपयोगकर्ता के कल्याण को नुकसान पहुंचाने के लिए डार्क पैटर्न्स और एआई-संचालित अनुशंसा एल्गोरिदम सहित अनैतिक व्यसनी डिजाइन युक्तियों का लाभ उठाती हैं, साथ ही कंटेंट मॉडरेशन के लिए उत्पन्न चुनौतियों का अन्वेषण करता है और नीति-स्तरीय समाधान प्रस्तावित करता है।

Michelle Nie2026-05-14
🤖 AI

VERA-MH Concept Paper

यह शोध पत्र VERA-MH को प्रस्तुत करता है, जो एक स्वचालित ढांचा है जो विशेष रूप से आत्महत्या के जोखिम के संबंध में, एक क्लिनिशियन द्वारा विकसित रूब्रिक के माध्यम से, मानसिक स्वास्थ्य चैटबॉट्स के सुरक्षा और नैतिक प्रदर्शन का मूल्यांकन करने के लिए सिम्युलेटेड (simulated) उपयोगकर्ता और जज AI एजेंटों का उपयोग करता है।

Luca Belli, Kate H. Bentley, Will Alexander, Emily Ward, Matt Hawrilenko, Kelly Johnston, Mill Brown, Adam M. Chekroud2026-05-14
🤖 machine learning

Energy Scaling Laws for Diffusion Models: Quantifying Compute in Image Generation

यह शोध पत्र एक अनुकूलित कपलान स्केलिंग लॉ (Kaplan scaling law) प्रस्तावित करता है जो इन्फरेंस को टेक्स्ट एनकोडिंग, डिनोइजिंग और डिकोडिंग घटकों में विभाजित करके डिफ्यूजन मॉडल्स के लिए GPU ऊर्जा खपत का सटीक अनुमान लगाता है, यह प्रदर्शित करते हुए कि डिनोइजिंग ऊर्जा उपयोग पर हावी है और टिकाऊ एआई नियोजन के लिए विश्वसनीय क्रॉस-आर्किटेक्चर अनुमान को सक्षम बनाता है।

Aniketh Iyengar, Jiaqi Han, Boris Ruf, Vincent Grari, Marcin Detyniecki, Stefano Ermon2026-05-14
💻 computer science

LLM Harms: A Taxonomy and Discussion

यह शोध पत्र प्री-डेवलपमेंट से लेकर डाउनस्ट्रीम एप्लिकेशन तक फैले लार्ज लैंग्वेज मॉडल (LLM) के नुकसानों का एक व्यापक वर्गीकरण प्रस्तावित करता है, जो जिम्मेदार एआई विकास और शमन के मार्गदर्शन के लिए मानकीकृत जवाबदेही, पारदर्शिता और गतिशील ऑडिटिंग प्रणालियों की वकालत करता है।

Kevin Chen, Saleh Afroogh, Abhejay Murali, David Atkinson, Amit Dhurandhar, Junfeng Jiao2026-05-14
💻 computer science

Copyright Laundering Through the AI Ouroboros: Adapting the 'Fruit of the Poisonous Tree' Doctrine to Recursive AI Training

यह शोध पत्र "फ्रूट ऑफ द पॉइज़नस ट्री" (विषैले वृक्ष का फल) सिद्धांत को अनुकूलित करके एक "AI-FOPT" मानक बनाने का प्रस्ताव करता है जो वैध उत्पत्ति सिद्ध करने का भार डाउनस्ट्रीम डेवलपर्स पर स्थानांतरित कर देता है जब यह पाया जाता है कि आधारभूत एआई मॉडलों को उल्लंघनकारी डेटा पर प्रशिक्षित किया गया है, जिससे कॉपीराइट को लॉन्डर करने के लिए उपयोग किए जाने वाले पुनरावर्ती सिंथेटिक डेटा पाइपलाइनों द्वारा उत्पन्न साक्ष्य संबंधी अदृश्य स्थानों को संबोधित किया जा सके।

Anirban Mukherjee, Hannah Hanwen Chang2026-05-14