💬 NLP

PsyScore: A Psychometrically-Aware Framework for Trait-Adaptive Essay Scoring and ZPD-Scaffolded Feedback

PsyScore एक साइकोमेट्रिकली-जागरूक ढांचा है जो सटीक क्षमता अनुमान और दक्षता-स्तर-अनुकूलित मार्गदर्शन प्रदान करने के लिए एक 'ट्रे़ट-एडैप्टिव न्यूरल IRT स्कोरर' को 'ZPD-स्कैफोल्डेड फीडबैक जनरेटर' के साथ एकीकृत करके स्वचालित निबंध स्कोरिंग और निर्देशात्मक फीडबैक को एकीकृत करता है।

Wei Xia, Jin Wu, Haoran Shi, Xiangyu Wang, Chanjin Zheng2026-06-19
💬 NLP

Your Mouse and Eyes Secretly Leak Your Preference: LLM Alignment using Implicit Feedback from Users

यह शोध पत्र IFLLM डेटासेट प्रस्तुत करता है, जो माउस ट्रैजेक्टरी और आई गेज़ (eye gaze) से प्राप्त अप्रत्यक्ष उपयोगकर्ता फीडबैक का लाभ उठाकर ऐसे रिवॉर्ड मॉडल को प्रशिक्षित करता है जो पारंपरिक टेक्स्ट-आधारित विधियों की तुलना में LLM अलाइनमेंट सटीकता और रिस्पॉन्स गुणवत्ता में महत्वपूर्ण सुधार करते हैं।

Haw-Shiuan Chang, Jeffrey Gomez, Mehul Patwari, Aryan Sajith, Hamed Zamani2026-06-19
💬 NLP

StylisticBias: A Few Human Visual Cues Drive Most Social Biases in MLLMs

यह शोधपत्र StylisticBias को प्रस्तुत करता है, जो 25,000 फोटोरियलिस्टिक छवियों के साथ एक नियंत्रित बेंचमार्क है जिसमें पृथक विशेषता परिवर्तन शामिल हैं, ताकि यह प्रकट किया जा सके कि संकेतों का एक छोटा समूह, विशेष रूप से फैशन शैली और शरीर के प्रकार, मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में सामाजिक पूर्वाग्रहों के अधिकांश हिस्से को संचालित करते हैं।

Shaghayegh Kolli, Timo Cavelius, Nafiseh Nikeghbal, Samantha Dalal, Jana Diesner2026-06-19
🤖 AI

LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents

LedgerAgent एक इन्फरेंस-टाइम विधि है जो ग्राहक-सेवा डोमेन में पॉलिसी-अनुपालन टूल-कॉलिंग एजेंटों को बेहतर बनाने के लिए एक अलग लेजर में टास्क स्टेट्स को बनाए रखती है ताकि सुसंगत निर्णय लेना सुनिश्चित किया जा सके और टूल निष्पादन से पहले पॉलिसी उल्लंघनों को सक्रिय रूप से रोका जा सके।

Md Nayem Uddin, Amir Saeidi, Eduardo Blanco, Chitta Baral2026-06-19
💬 NLP

Media Framing through the Lens of Event-Centric Narratives

यह शोध पत्र एक ऐसे ढांचे का प्रस्ताव करता है जो घटनाओं को उच्च-स्तरीय आख्यानों (नैरेटिव्स) में निकालता और समूहित करता है ताकि यह समझाया जा सके कि समाचार मीडिया फ्रेमिंग उपकरणों का निर्माण कैसे करता है, जो अप्रवास और बंदूक नियंत्रण के अमेरिकी समाचार कवरेज का विश्लेषण करने में इसकी प्रभावशीलता को प्रदर्शित करता है।

Rohan Das, Aditya Chandra, I-Ta Lee, Maria Leonor Pacheco2026-06-18
💬 NLP

Bandit-Based Prompt Design Strategy Selection Improves Prompt Optimizers

यह शोध पत्र OPTS को प्रस्तुत करता है, जो एक प्रॉम्प्ट ऑप्टिमाइज़ेशन फ्रेमवर्क है जो स्पष्ट, बैंडिट-आधारित तंत्र (विशेष रूप से थॉम्पसन सैंपलिंग) को लागू करके EvoPrompt जैसे मौजूदा ऑप्टिमाइज़र के प्रदर्शन को बढ़ाता है ताकि प्रॉम्प्ट डिज़ाइन रणनीतियों को प्रभावी ढंग से चुना और लागू किया जा सके, जिससे यह उन तरीकों से बेहतर प्रदर्शन करता है जो निहित रणनीति चयन पर निर्भर करते हैं।

Rin Ashizawa, Yoichi Hirose, Nozomu Yoshinari, Kento Uchida, Shinichi Shirakawa2026-06-18
💬 NLP

Assessment of Evolving Large Language Models in Upper Secondary Mathematics

यह अध्ययन प्रदर्शित करता है कि विकसित होते बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) गणितीय दक्षता में तेजी से उन्नत हुए हैं, जो मध्यम प्रदर्शन से लेकर फिनिश उच्च माध्यमिक मैट्रिकुलेशन परीक्षा में लगभग पूर्ण अंक प्राप्त करने तक प्रगति कर चुके हैं, जिससे गणित शिक्षा में सहायता के लिए शक्तिशाली उपकरण के रूप में उनकी क्षमता उजागर होती है।

Mika Setälä, Pieta Sikström, Ville Heilala, Tommi Kärkkäinen2026-06-18
💬 NLP

A Systematic Review on the Generative AI Applications in Human Medical Genomics

यह व्यवस्थित समीक्षा मानव चिकित्सा जीनोमिक्स, विशेष रूप से वेरिएंट व्याख्या, निदान और आनुवंशिक शिक्षा को आगे बढ़ाने में लार्ज लैंग्वेज मॉडल्स की परिवर्तनकारी क्षमताओं और निरंतर चुनौतियों का मूल्यांकन करने के लिए 172 अध्ययनों का विश्लेषण करती है।

Anton Changalidis, Yury Barbitoff, Yulia Nasykhova, Andrey Glotov2026-06-18
💬 NLP

KNIGHT: Knowledge Graph-Driven Multiple-Choice Question Generation with Adaptive Hardness Calibration

KNIGHT एक नॉलेज ग्राफ-संचालित फ्रेमवर्क है जो बाहरी स्रोतों से उच्च-गुणवत्ता वाले, कठिनाई-नियंत्रित बहुविकल्पीय प्रश्न डेटासेट को कुशलतापूर्वक उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे RAG सिस्टम के मूल्यांकन के लिए मैनुअल असेसमेंट निर्माण की लागत और समय संबंधी बाधाओं को दूर किया जा सके।

Mohammad Amanlou, Erfan Shafiee Moghaddam, Yasaman Amou Jafari, Mahdi Noori, Farhan Farsi, Behnam Bahrak2026-06-18
💬 NLP

MedicalAgentsBench for Complex Medical Reasoning: Comparing Internalized Reasoning Models versus Externalized Agent-based Frameworks

यह शोध पत्र MedicalAgentsBench प्रस्तुत करता है, जो 862 जटिल नैदानिक प्रश्नों का एक क्यूरेटेड बेंचमार्क है, यह प्रदर्शित करने के लिए कि आंतरिक तर्क मॉडल (internalized reasoning models) को बाहरी एजेंट-आधारित ढांचे (externalized agent-based frameworks) के साथ संयोजित करने से अकेले किसी भी दृष्टिकोण की तुलना में बेहतर प्रदर्शन और लागत-दक्षता प्राप्त होती है।

Yanjun Shao, Xiangru Tang, Jiwoong Sohn, Jiapeng Chen, Yuxuan Liao, Jiayi Zhang, Jinyu Xiang, Fang Wu, Yilun Zhao, Cheng (…)2026-06-17