💻 computer science

The Ephemeral Web and the Case for Proactive Archiving

पाकिस्तान एंबेसी इंटरनेशनल स्कूल एंड कॉलेज तेहरान के एक केस स्टडी और डिजिटल भंगुरता (डिजिटल फ्रैजिलिटी) के साथ लेखक के व्यक्तिगत अनुभवों का उपयोग करते हुए, यह शोध पत्र तर्क देता है कि वेब की संरचनात्मक क्षणभंगुरता का मुकाबला करने और संस्थागत स्मृति को संरक्षित करने के लिए सक्रिय, स्वचालित आर्काइविंग (संग्रहण) वेबसाइट रखरखाव का एक मानक घटक बनना चाहिए।

Meliksah Yorulmazlar2026-05-22
💻 computer science

Faster Completion, Less Learning: Generative AI Reduced Study Time on Math Problems and the Knowledge They Build

एक दशक के ALEKS डेटा का उपयोग करने वाला यह बड़े पैमाने पर किया गया अध्ययन यह प्रकट करता है कि जनरेटिव एआई ने संवेदनशील गणितीय समस्याओं पर छात्रों के अध्ययन के समय को काफी कम कर दिया है और साथ ही उनके दीर्घकालिक ज्ञान प्रतिधारण (नॉलेज रिटेंशन) को भी खराब कर दिया है, एक ऐसी घटना जिसे लेखक "संज्ञानात्मक आत्मसमर्पण" (कॉग्निटिव सरेंडर) के रूप में पहचानते हैं।

Sina Rismanchian, Hasan Uzun, Jeffrey Matayoshi, Eric Cosyn, Eyad Kurd-Misto2026-05-22
💻 computer science

Addressing the Synergy Gap: The Six Elements of the Design Space

यह शोध पत्र उस निरंतर "सिनर्जी गैप" (सहयोग अंतराल) की पहचान करता है जहाँ मानव-एआई संयोजन अकेले किसी भी पक्ष के प्रदर्शन से बेहतर होने में विफल रहते हैं, और यह तर्क देता है कि इस अंतर को पाटने के लिए संकीर्ण इंजीनियरिंग सुधारों से आगे बढ़कर छह परस्पर जुड़े तत्वों वाले एक व्यापक डिज़ाइन स्पेस के साथ स्पष्ट रूप से जुड़ना आवश्यक है: सामाजिक-तकनीकी संदर्भ, निर्णय लेने के ढांचे, मानव प्रतिभागी, एआई क्षमताएं, इंटरेक्शन (परस्पर क्रिया), और समग्र मूल्यांकन।

Tommaso Turchi, Ben Wilson, Matt Roach, Alan Dix, Alessio Malizia2026-05-22
🔬 physics

From Licensing to Open Access: Designing a Sustainable Transition in Operational Weather Data

यह शोध पत्र अक्टूबर 2025 तक CC BY 4.0 के तहत एक प्रतिबंधित लाइसेंसिंग मॉडल से ओपन एक्सेस की ओर यूरोपीय सेंटर फॉर मीडियम-रेंज वेदर फोरकास्ट्स (ECMWF) के सफल संक्रमण को प्रलेखित करता है, जो एक पुनरावृत्त, टियर्ड सेवा दृष्टिकोण के माध्यम से यह प्रदर्शित करता है कि पूर्व भुगतान करने वाले ग्राहकों की उच्च प्रतिधारण दर बनाए रखते हुए और वैश्विक डेटा पहुंच में उल्लेखनीय वृद्धि करते हुए परिचालन स्थिरता और ओपन डेटा दायित्वों का सामंजस्य बिठाया जा सकता है।

Emma Pidduck, Umberto Modigliani, Victoria L. Bennett, Fabio Venuti, Florian Pappenberger, Florence Rabier2026-05-22
💻 computer science

Barriers to Evidence in AI-Related Cases and the Privatization of Proof

यह शोध पत्र तर्क देता है कि एआई (AI) प्रणालियों पर मालिकाना नियंत्रण एक "प्रमाण के निजीकरण" को जन्म देता है जो पहुंच में सात प्रमुख विषमताओं को उत्पन्न करके मुकदमेबाजी में बाधा डालता है, और इन साक्ष्य विवादों को हल करने के लिए आनुपातिकता और विनिमेय पहुंच विकल्पों पर आधारित एक तीन-स्तरीय परीक्षण का प्रस्ताव करता है।

Sarah H. Cen, Hannah Ismael, Lucia Zheng2026-05-22
💬 NLP

Epicure: Navigating the Emergent Geometry of Food Ingredient Embeddings

यह शोध पत्र एपिक्योर (Epicure) प्रस्तुत करता है, जो 4.14 मिलियन व्यंजनों पर प्रशिक्षित बहुभाषी सामग्री एम्बेडिंग का एक परिवार है, जो सामग्री सह-उपस्थिति और रासायनिक स्वाद यौगिकों के एक हाइब्रिड ग्राफ में नेविगेट करने के लिए विशिष्ट रैंडम-वॉक स्कीमा का उपयोग करता है, जिससे मॉडल को रेसिपी संदर्भ और रासायनिक संरचना के बीच एक स्पेक्ट्रम के विभिन्न बिंदुओं पर स्थित किया जा सके।

Jakub Radzikowski, Josef Chen2026-05-22
💻 computer science

Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions

यह शोध पत्र तर्क देता है कि स्वास्थ्य सेवा (हेल्थकेयर) LLM बेंचमार्क प्रदर्शन और वास्तविक दुनिया में तैनाती के बीच का अंतर उपयोगकर्ता व्यवहार के अप्रमाणित अंतर्निहित धारणाओं से उत्पन्न होता है, जो इन धारणाओं को वर्गीकृत करने के लिए एक रूपरेखा प्रस्तावित करता है और उन्हें व्यवस्थित रूप से संबोधित करने के लिए "बेंचमार्ककार्ड्स" (BenchmarkCards) और चरणबद्ध मूल्यांकन पेश करता है।

Naveen Raman, Santiago Cortes-Gomez, Mateo Dulce Rubio, Fei Fang, Bryan Wilder2026-05-22
💻 computer science

The efficiency-gain illusion: People underestimate the rate of AI use and overestimate its benefits on simple tasks

2,691 प्रतिभागियों को शामिल करने वाले तीन पूर्व-पंजीकृत अध्ययनों के माध्यम से, यह शोध पत्र प्रकट करता है कि लोग एक दोहरे गलत अंशांकन (dual miscalibration) के कारण सरल कार्यों के लिए बार-बार और अक्षम रूप से एआई (AI) पर निर्भर होते हैं, जिसमें वे अपने स्वयं के उपयोग को कम आंकते हैं जबकि समय और प्रयास की बचत का अत्यधिक आकलन करते हैं, एक ऐसा पूर्वाग्रह जिसे सत्र-स्तर के कैरीओवर प्रभाव द्वारा और अधिक सुदृढ़ किया जाता है।

Sunny Yu, Myra Cheng, Ahmad Jabbar, Ilia Sucholutsky, Katherine M. Collins, Dan Jurafsky, Robert D. Hawkins2026-05-22
🤖 AI

Can Synthetic Data be Fair and Private? A Comparative Study of Synthetic Data Generation and Fairness Algorithms

यह अध्ययन प्रदर्शित करता है कि जबकि DECAF सिंथेटिक डेटा जनरेटर कम उपयोगिता के बावजूद गोपनीयता और निष्पक्षता के बीच सबसे अच्छा संतुलन प्रदान करता है, सिंथेटिक डेटा पर प्री-प्रोसेसिंग निष्पक्षता एल्गोरिदम लागू करने से वास्तविक डेटा पर उनके अनुप्रयोग की तुलना में बेहतर निष्पक्षता सुधार प्राप्त होते हैं, जो नैतिक शिक्षण विश्लेषण के लिए एक आशाजनक हाइब्रिड दृष्टिकोण का सुझाव देता है।

Qinyi Liu, Oscar Deho, Sam Urmian, Mohammad Khalil, Srecko Joksimovic, George Siemens2026-05-21
💬 NLP

Measuring and mitigating overreliance to build human-compatible AI

यह शोध पत्र तर्क देता है कि बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) पर अत्यधिक निर्भरता को मापना और कम करना उच्च-जोखिम वाली त्रुटियों और संज्ञानात्मक कौशल ह्रास (कॉग्निटिव डेस्किलिंग) को रोकने के लिए महत्वपूर्ण है, जो जोखिमों को समेकित करने, मापन संबंधी कमियों को दूर करने और ऐसी रणनीतियों को लागू करने के लिए एक रूपरेखा प्रस्तावित करता है जो यह सुनिश्चित करती है कि एआई मानवीय क्षमताओं को कम करने के बजाय उन्हें सुदृढ़ करे।

Lujain Ibrahim, Katherine M. Collins, Sunnie S. Y. Kim, Anka Reuel, Max Lamparth, Kevin Feng, Lama Ahmad, Prajna Soni, A (…)2026-05-21