💻 computer science

Preregistration for Experiments with AI Agents

यह शोध पत्र पद्धतिगत कमजोरियों को कम करने और विश्वसनीयता बढ़ाने के लिए एआई एजेंटों के साथ प्रयोगों में प्री-रजिस्ट्रेशन प्रथाओं को अनिवार्य रूप से अपनाने का समर्थन करता है, साथ ही मॉडल चयन और प्रॉम्प्ट इंजीनियरिंग जैसे विशिष्ट शोधकर्ता स्वतंत्रता स्तरों (researcher degrees of freedom) को संबोधित करने के लिए एक अनुकूलित टेम्पलेट भी प्रदान करता है।

Michelle Vaccaro2026-06-11
🤖 AI

Can AI Agents Synthesize Scientific Conclusions?

यह शोध पत्र SciConBench और एक क्लीन-रूम मूल्यांकन हारनेस (clean-room evaluation harness) प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि वर्तमान एआई एजेंट डेटा लीकेज के कारण अनियंत्रित सेटिंग्स में प्रदर्शन को काफी अधिक बढ़ा-चढ़ाकर दिखाने के बावजूद, सटीक वैज्ञानिक निष्कर्षों को विश्वसनीय रूप से संश्लेषित करने में संघर्ष करते हैं।

Hayoung Jung, Pedro Viana Diniz, José Reinaldo Corrêa Roveda, Abner Fernandes da Silva, Haeun Jung, Enoch Tsai, Aleksand (…)2026-06-11
💬 NLP

AI Coding Agents in Social Science: Methodologically Diverse, Empirically Consistent, Interpretively Vulnerable

यह अध्ययन पाता है कि जबकि एआई कोडिंग एजेंट मानवीय पद्धतिगत विविधता के बराबर या उससे अधिक हो सकते हैं और अनुभवजन्य रूप से सुसंगत अनुमान उत्पन्न कर सकते हैं, वे व्याख्यात्मक पूर्वाग्रह के प्रति विशिष्ट रूप से संवेदनशील बने रहते हैं, जहाँ स्पष्ट प्रॉम्प्ट अंतर्निहित डेटा विश्लेषण को बदले बिना उनके अंतिम निष्कर्षों को नाटकीय रूप से बदल सकते हैं।

Meysam Alizadeh, Fabrizio Gilardi, Mohsen Mosleh, Enkelejda Kasneci2026-06-11
🤖 AI

AI Researchers Must Help Lead Arms Control to Mitigate Military AI Risks

यह शोध पत्र तर्क देता है कि एआई शोधकर्ताओं को केवल दीर्घकालिक सुपरइंटेलिजेंस संबंधी चिंताओं पर ध्यान केंद्रित करने के बजाय, सैन्य एआई अनुप्रयोगों के तत्काल जोखिमों को कम करने के लिए शस्त्रागार नियंत्रण अनुसंधान और तकनीकी सत्यापन को आगे बढ़ाने में अग्रणी भूमिका निभानी चाहिए।

Ted Fujimoto, Jacob Benz2026-06-11
💻 computer science

Learning by Chatting? Investigating the Impact of Generative AI on Information Seeking and Learning

ChatGPT के माध्यम से 8-दिवसीय अनौपचारिक शिक्षण बनाम गूगल सर्च की तुलना करने वाला एक क्षेत्रीय प्रयोग यह प्रकट करता है कि जहाँ जनरेटिव एआई (GenAI) सुविधा प्रदान करता है, वहीं अंततः यह खराब सीखने के परिणामों की ओर ले जाता—विशेष रूप से आलोचनात्मक सोच में—क्योंकि यह उपयोगकर्ता की एजेंसी को कम करता है, मेटा-कॉग्निटिव लोड (meta-cognitive load) को बढ़ाता है और समाधान-केंद्रित पूर्वाग्रहों के माध्यम से सूचना अन्वेषण को सीमित करता है।

Shravika Mittal, Su Lin Blodgett, Q. Vera Liao2026-06-11
💬 NLP

Beyond Third-Person Audits: Situated Interaction Auditing for User-Centered LLM Bias Research

यह शोध पत्र सिचुएटेड इंटरैक्शन ऑडिटिंग (SIA) का प्रस्ताव करता है, जो एक उपयोगकर्ता-केंद्रित ढांचा है जो यह जांचकर पारंपरिक तृतीय-पक्ष ऑडिट की सीमाओं को संबोधित करता है कि कैसे LLMs व्यक्तिगत बातचीत के दौरान लिंग और सामाजिक-आर्थिक स्थिति जैसे उपयोगकर्ता प्रोफाइल संकेतों के आधार पर अपनी प्रतिक्रियाओं को व्यवस्थित रूप से बदलते हैं।

Andrés Abeliuk, Cinthia Sanchez Macias, Valentina Alarcón, Álvaro Madariaga, Claudia Lopez2026-06-11
💻 computer science

Support for AI Development -- Automated Daily Measurement with Open Data and Code

यह शोध पत्र एआई (AI) विकास के प्रति अमेरिकी समर्थन को ट्रैक करने के लिए एक वेब डैशबोर्ड का उपयोग करते हुए, दैनिक जनमत नाउकास्टिंग (nowcasting) के लिए एक ओपन-सोर्स, स्वचालित प्रणाली का समर्थन और प्रदर्शन करता है, और यह तर्क देता है कि परिवर्तनकारी प्रौद्योगिकियों के प्रति दृष्टिकोण में बदलावों की सटीक निगरानी करने के लिए इस तरह की उच्च-आवृत्ति, पारदर्शी विधियाँ आवश्यक हैं।

Jason Jeffrey Jones2026-06-10
🤖 AI

Status and Future Prospects of the Standardization Framework Industry 4.0: A European Perspective

यह शोध पत्र यूरोप के इंडस्ट्री 4.0 ढांचे में मानकीकरण की महत्वपूर्ण भूमिका को रेखांकित करता है, जो विशेष रूप से इंटेलिजेंट मैन्युफैक्चरिंग और डिजिटल ट्विन्स पर केंद्रित है, साथ ही भविष्य के नवाचार को गति देने के लिए मानकीकरण निकायों और अनुसंधान समुदाय के बीच बेहतर सहयोग का समर्थन करता है।

Olga Meyer, Marvin Boell, Christoph Legat2026-06-10
💻 computer science

Large Language Model Chatbot Conversations vs Public Health Materials and Parental HPV Vaccination Intentions: A Randomized Clinical Trial

इस रैंडमाइज्ड क्लिनिकल ट्रायल ने पाया कि जबकि सरकारी सार्वजनिक स्वास्थ्य सामग्री और एलएलएम (LLM) चैटबॉट इंटरैक्शन दोनों ने बिना किसी हस्तक्षेप की तुलना में शुरुआत में माता-पिता के एचपीवी (HPV) टीकाकरण के इरादों को बढ़ाया, केवल सार्वजनिक स्वास्थ्य सामग्री ने 45 दिनों तक इन प्रभावों को बनाए रखा, जिसमें दोनों में से कोई भी दृष्टिकोण वास्तविक टीकाकरण अपटेक (uptake) में वृद्धि करने में सफल नहीं रहा।

Neil K. R. Sehgal, Sunny Rai, Manuel Tonneau, Anish K. Agarwal, Joseph Cappella, Melanie Kornides, Lyle Ungar, Alison Bu (…)2026-06-10
🤖 AI

Position: The ML Community Must Build an AI-Augmented Peer-Review Ecosystem

यह स्थिति पत्र (position paper) तर्क देता है कि मशीन लर्निंग समुदाय को पैमाने के संकट को संबोधित करने के लिए बड़े भाषा मॉडलों (Large Language Models) को सहयोगात्मक उपकरणों के रूप में उपयोग करते हुए, वैज्ञानिक अखंडता बनाए रखने के लिए संरचित डेटा पहुंच और एक कठोर अनुसंधान एजेंडे पर जोर देते हुए, एक एआई-संवर्धित सहकर्मी-समीक्षा पारिस्थितिकी तंत्र विकसित करने हेतु तत्काल कार्य करना चाहिए।

Qiyao Wei, Samuel Holt, Jing Yang, Markus Wulfmeier, Mihaela van der Schaar2026-06-10