💬 NLP

Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions

यह सर्वेक्षण कानूनी अनुप्रयोगों में बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के मूल्यांकन के लिए चुनौतियों का व्यवस्थित रूप से परीक्षण करता है, मौजूदा मूल्यांकन विधियों और बेंचमार्क को वर्गीकृत करता है, और भविष्य की दिशाओं को रेखांकित करता है ताकि यह सुनिश्चित किया जा सके कि उनकी तर्क क्षमता, निष्पक्षता और विश्वसनीयता वास्तविक दुनिया के कानूनी अभ्यास के अनुरूप हो।

Yiran Hu, Huanghai Liu, Chong Wang, Kunran Li, Tien-Hsuan Wu, Haitao Li, Xinran Xu, Siqing Huo, Weihang Su, Ning Zheng (…)2026-01-22
💻 computer science

Truth Knows No Language: Evaluating Truthfulness Beyond English

यह शोध पत्र बास्क, कैटलन, गैलिशियन और स्पेनिश के लिए TruthfulQA बेंचमार्क के एक पेशेवर रूप से अनुवादित विस्तार को प्रस्तुत करता है ताकि 12 अत्याधुनिक (state-of-the-art) LLMs का मूल्यांकन किया जा सके, जो यह प्रकट करता है कि हालांकि प्रदर्शन संसाधन स्तर के अनुसार भिन्न होता है, भाषाओं के बीच सत्यनिष्ठा (truthfulness) संबंधी विसंगतियां अपेक्षा से कम हैं और मशीन अनुवाद क्रॉस-लिंगुअल सत्यनिष्ठा मूल्यांकन के लिए एक स्केलेबल विकल्प प्रदान करता है।

Blanca Calvo Figueras, Eneko Sagarzazu, Julen Etxaniz, Jeremy Barnes, Pablo Gamallo, Iria de-Dios-Flores, Rodrigo Agerri2026-01-15
💻 computer science

A Personalised Formal Verification Framework for Monitoring Activities of Daily Living of Older Adults Living Independently in Their Homes

यह शोध पत्र एक व्यक्तिगत औपचारिक सत्यापन ढांचे (personalized formal verification framework) को प्रस्तुत करता है जो स्वतंत्र रूप से रहने वाले वृद्ध वयस्कों के लिए दैनिक जीवन की गतिविधियों (Activities of Daily Living) को मॉडल और औपचारिक रूप से सत्यापित करने हेतु सेंसर डेटा को व्यक्तिगत संदर्भ के साथ एकीकृत करता है, जिसमें सुरक्षा उल्लंघनों का पता लगाने और व्याख्यात्मक प्रति-उदाहरण (explanatory counterexamples) उत्पन्न करने के लिए लीनियर टेम्पोरल लॉजिक (Linear Temporal Logic) का उपयोग किया गया है।

Ricardo Contreras, Filip Smola, Nuša Farič, Jiawei Zheng, Jane Hillston, Jacques D. Fleuriot2026-01-15
💻 computer science

Designing AI for Prosecutorial Governance: Case Prioritization and Statutory Oversight in Mexico

यह शोध पत्र मेक्सिको के ज़काटेकास स्टेट प्रॉसिक्यूटर'स ऑफिस के लिए सह-विकसित एक मशीन लर्निंग सिस्टम प्रस्तुत करता है जो केस समाधान की समयसीमा का पूर्वानुमान लगाने के लिए रैंडम फॉरेस्ट क्लासिफायर का उपयोग करता है, जिससे मौजूदा कार्यप्रवाह को बाधित किए बिना अभियोजक दक्षता में सुधार करने के लिए प्राथमिकता वाली सूचियाँ तैयार की जाती हैं।

Fernanda Sobrino, Adolfo De Unánue T., Edgar Hernández, Patricia Villa, Elena Villalobos, David Aké, Stephany Cisneros (…)2026-01-15
💻 computer science

Regulatory gray areas of LLM Terms

यह शोध पत्र नवंबर 2025 तक पांच प्रमुख एलएलएम (LLM) प्रदाताओं की सेवा की शर्तों का विश्लेषण करता है ताकि उन नियामक अनिश्चितताओं और उपयोग संबंधी प्रतिबंधों की पहचान की जा सके जो शैक्षणिक शोधकर्ताओं के लिए अनिश्चितता पैदा करते हैं, और साथ ही इन विकसित होते कानूनी परिदृश्यों को समझने में मदद करने के लिए एक तुलनात्मक संसाधन भी प्रदान करता है।

Brittany I. Davidson, Kate Muir, Florian A. D. Burnat, Adam N. Joinson2026-01-15
💻 computer science

A Review: PTSD in Pre-Existing Medical Condition on Social Media

यह समीक्षा 2008 से 2024 तक के साहित्य का संश्लेषण करती है ताकि यह प्रदर्शित किया जा सके कि कैसे सोशल मीडिया विश्लेषण, एनएलपी (NLP) और मशीन लर्निंग का उपयोग करते हुए, सहवर्ती पीटीएसडी (PTSD) और पुरानी बीमारियों की अनूठी चुनौतियों को उजागर करता है और प्रारंभिक हस्तक्षेप एवं लक्षित सहायता के लिए ऑनलाइन समुदायों की क्षमता को रेखांकित करता है।

Zaber Al Hassan Ayon, Nur Hafieza Ismail, Nur Shazwani Kamarudin2026-01-15
💻 computer science

Emissions and Performance Trade-off Between Small and Large Language Models

यह अध्ययन प्रदर्शित करता है कि फाइन-ट्यून किए गए स्मॉल लैंग्वेज मॉडल्स विभिन्न कार्यों में लार्ज लैंग्वेज मॉडल्स के समान प्रदर्शन प्राप्त कर सकते हैं और साथ ही कार्बन उत्सर्जन को भी काफी कम कर सकते हैं, जो टिकाऊ एआई की दिशा में एक व्यवहार्य मार्ग प्रदान करते हैं।

Anandita Garg, Uma Gaba, Deepan Muthirayan, Anish Roy Chowdhury2026-01-15
💻 computer science

The Inconsistency Critique: Epistemic Practices and AI Testimony About Inner States

यह शोध पत्र एक "विसंगति आलोचना" (inconsistency critique) को आगे बढ़ाता है जो यह तर्क देता है कि एआई के संबंध में हमारे ज्ञानमीमांसीय अभ्यास संरचनात्मक रूप से त्रुटिपूर्ण हैं क्योंकि हम अधिकांश क्षेत्रों में एआई के आउटपुट को साक्ष्य (testimony) के रूप में चयनात्मक रूप से स्वीकार करते हैं, जबकि आंतरिक अवस्थाओं के बारे में उनके दावों को श्रेणीबद्ध रूप से खारिज कर देते हैं, एक ऐसा पूर्वग्रह जो इस बात की परवाह किए बिना ज्ञानमीमांसीय स्वच्छता (epistemological hygiene) को कमजोर करता है कि क्या एआई प्रणालियों के पास अंततः नैतिक रूप से प्रासंगिक हित हैं।

Gerol Petruzella2026-01-15
💻 computer science

Adaptive Trust Metrics for Multi-LLM Systems: Enhancing Reliability in Regulated Industries

यह शोध पत्र मल्टी-एलएलएम (multi-LLM) प्रणालियों के लिए अनुकूली विश्वास मेट्रिक्स (adaptive trust metrics) का एक ढांचा प्रस्तावित करता है जो गतिशील निगरानी और अनिश्चितता मूल्यांकन के माध्यम से स्वास्थ्य सेवा और वित्त जैसे विनियमित उद्योगों में विश्वसनीयता को परिमाणित करता है और जवाबदेही सुनिश्चित करता है।

Tejaswini Bollikonda2026-01-15
💻 computer science

Stimulating Higher Order Thinking in Mechatronics by Comparing PID and Fuzzy Control

यह शोध पत्र एक सेमेस्टर-लंबे मेक्ट्रोनिक्स प्रोजेक्ट को प्रस्तुत करता है जहाँ छात्र बिना किसी पूर्व-निर्धारित मानदंड के लीडर-फॉलोअर व्यवहार के लिए PID और फजी कंट्रोल की तुलना करते हैं, जो उन्हें एक ओपन-एंडेड, वास्तविक दुनिया की इंजीनियरिंग समस्या को हल करने के लिए अपने स्वयं के मूल्यांकन तरीकों और प्रयोगों को डिजाइन करने की आवश्यकता के माध्यम से उच्च-स्तरीय सोच कौशल विकसित करने में सफलतापूर्वक सक्षम बनाता है।

Christopher J. Lowrance, John R. Rogers2026-01-15