💬 NLP

GLEN-Bench: A Graph-Language based Benchmark for Nutritional Health

यह शोध पत्र GLEN-Bench को प्रस्तुत करता है, जो पोषण संबंधी स्वास्थ्य के लिए पहला ग्राफ-लैंग्वेज बेंचमार्क है, जो वास्तविक दुनिया की बाधाओं और व्याख्यात्मकता की कमियों को दूर करने के लिए तीन जुड़े हुए कार्यों: जोखिम का पता लगाना, व्यक्तिगत खाद्य अनुशंसा, और ग्राफ-ग्राउंडेड प्रश्नोत्तर के माध्यम से विविध डेटासेट को एकीकृत करता है।

Jiatan Huang, Zheyuan Zhang, Tianyi Ma, Mingchen Li, Yaning Zheng, Yanfang Ye, Chuxu Zhang2026-01-27
💬 NLP

Typhoon-S: Minimal Open Post-Training for Sovereign Large Language Models

यह शोध पत्र टाइफून S (Typhoon S) को प्रस्तुत करता है, जो एक न्यूनतम और ओपन पोस्ट-ट्रेनिंग रेसिपी है जो सुपरवाइज्ड फाइन-ट्यूनिंग, ऑन-पॉलिसी डिस्टिलेशन, और InK-GRPO के साथ लघु-स्तरीय RFT को संयोजित करती है ताकि यह प्रदर्शित किया जा सके कि विशाल इंस्ट्रक्शन कॉर्पोरा या जटिल सुदृढीकरण शिक्षण (reinforcement learning) पाइपलाइनों पर निर्भर हुए बिना, अकादमिक-स्तर के संसाधनों के तहत थाई कानूनी तर्क जैसे क्षेत्र-विशिष्ट कार्यों में सक्षम उच्च-गुणवत्ता वाले, संप्रभु लार्ज लैंग्वेज मॉडल्स विकसित किए जा सकते हैं।

Kunat Pipatanakul, Pittawat Taveekitworachai2026-01-27
💬 NLP

PaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR

यह शोधपत्र PaperSearchQA प्रस्तुत करता है, जो एक ढांचा और डेटासेट है जिसमें 60k चुनौतीपूर्ण बायोमेडिकल QA नमूने और एक 16-मिलियन-एब्स्ट्रैक्ट कॉर्पस शामिल है, जिसे भविष्य के AI साइंटिस्ट सिस्टम की क्षमताओं को आगे बढ़ाने के लिए वैज्ञानिक साहित्य पर प्रभावी ढंग से खोजने और तर्क करने हेतु सत्यापन योग्य पुरस्कारों (RLVR) के साथ सुदृढीकरण लर्निंग एजेंटों (reinforcement learning agents) को प्रशिक्षित करने के लिए डिज़ाइन किया गया है।

James Burgess, Jan N. Hansen, Duo Peng, Yuhui Zhang, Alejandro Lozano, Min Woo Sun, Emma Lundberg, Serena Yeung-Levy2026-01-27
💬 NLP

Generative AI in Saudi Arabia: A National Survey of Adoption, Risks, and Public Perceptions

यह अध्ययन 330 सऊदी प्रतिभागियों के एक राष्ट्रव्यापी सर्वेक्षण को प्रस्तुत करता है जो यह दर्शाता है कि जहाँ बुनियादी कार्यों के लिए GenAI को अपनाना उच्च है, वहीं असमान तकनीकी साक्षरता, गोपनीयता और आलोचनात्मक सोच के संबंध में महत्वपूर्ण चिंताएँ, और संरचित, सांस्कृतिक रूप से संरेखित प्रशिक्षण की प्रबल मांग विजन 2030 के तहत नीति निर्माताओं के लिए प्रमुख प्राथमिकताओं को रेखांकित करती है।

Abdulaziz AlDakheel, Ali Alshehre, Esraa Alamoudi, Moslim AlKhabbaz, Ahmed Aljohani, Raed Alharbi2026-01-27
💬 NLP

FGGM: Fisher-Guided Gradient Masking for Continual Learning

यह शोध पत्र फिशर-गाइडेड ग्रेडिएंट मास्किंग (FGGM) का प्रस्ताव करता है, जो एक डेटा-मुक्त निरंतर शिक्षण (continual learning) ढांचा है जो डायगोनल फिशर इंफॉर्मेशन का लाभ उठाकर पैरामीटर अपडेट को गतिशील रूप से मास्क करता है, जिससे बड़े भाषा मॉडलों में कैटास्ट्रोफिक फॉरगेटिंग को प्रभावी ढंग से कम किया जाता है और TRACE बेंचमार्क पर MIGU और सुपरवाइज्ड फाइन-ट्यूनिंग जैसी मौजूदा विधियों से बेहतर प्रदर्शन किया जाता है।

Chao-Hong Tan, Qian Chen, Wen Wang, Yukun Ma, Chong Zhang, Chong Deng, Qinglin Zhang, Xiangang Li, Jieping Ye2026-01-27
💬 NLP

Designing large language model prompts to extract scores from messy text: A shared dataset and challenge

यह शोध पत्र 1,446 अव्यवस्थित अनुसंधान ग्रंथों के एक साझा डेटासेट को यूके (UK) गुणवत्ता स्कोर के साथ और एक संबंधित चुनौती को प्रस्तुत करता है, जिसका उद्देश्य सटीक स्कोर निकालने या लुप्त मानों की पहचान करने के लिए इष्टतम लार्ज लैंग्वेज मॉडल (LLM) प्रॉम्प्ट्स को डिजाइन करना है, ताकि 72.6% सटीकता के प्रारंभिक बेसलाइन से आगे बढ़कर जटिल संख्यात्मक कार्यों के लिए प्रॉम्प्ट इंजीनियरिंग की समझ को उन्नत किया जा सके।

Mike Thelwall2026-01-27
💬 NLP

Calibrating Beyond English: Language Diversity for Better Quantized Multilingual LLM

यह शोध पत्र प्रदर्शित करता है कि केवल अंग्रेजी वाले कैलिब्रेशन सेट्स को विविध, भाषा-विशिष्ट या बहुभाषी डेटा से बदलने से क्वांटाइज्ड बहुभाषी एलएलएम (LLMs) की परप्लेक्सिटी में महत्वपूर्ण सुधार होता है, जो यह दर्शाता है कि विभिन्न भाषाओं और क्वांटाइजेशन विधियों में सुदृढ़ प्रदर्शन के लिए भाषाई संरेखण अत्यंत महत्वपूर्ण है।

Everlyn Asiko Chimoto, Mostafa Elhoushi, Bruce A. Bassett2026-01-27
💬 NLP

MultiVis-Agent: A Multi-Agent Framework with Logic Rules for Reliable and Comprehensive Cross-Modal Data Visualization

यह शोध पत्र MultiVis-Agent को प्रस्तुत करता है, जो एक लॉजिक रूल-एन्हांस्ड मल्टी-एजेंट फ्रेमवर्क है जो जटिल परिदृश्यों में विश्वसनीय और व्यापक क्रॉस-मोडल डेटा विज़ुअलाइज़ेशन सुनिश्चित करता है, और मौजूदा बेसलाइन्स की तुलना में बेहतर प्रदर्शन और लगभग पूर्ण कार्य पूर्णता दर प्राप्त करता है।

Jinwei Lu, Yuanfeng Song, Chen Zhang, Raymond Chi-Wing Wong2026-01-27
💬 NLP

Overalignment in Frontier LLMs: An Empirical Study of Sycophantic Behaviour in Healthcare

यह अध्ययन एक सुदृढ़ ढांचे और 'एडजस्टेड साइकोफैंसी स्कोर' (Adjusted Sycophancy Score) को प्रस्तुत करता है ताकि अनुभवजन्य रूप से यह प्रदर्शित किया जा सके कि अत्याधुनिक एलएलएम (LLMs), विशेष रूप से तर्क-अनुकूलित "थिंकिंग" मॉडल, स्वास्थ्य सेवा के परिवेश में खतरनाक चापलूसीपूर्ण व्यवहार प्रदर्शित करते हैं जहाँ बेंचमार्क सटीकता नैदानिक विश्वसनीयता का पूर्वानुमान लगाने में विफल रहती है।

Clément Christophe, Wadood Mohammed Abdul, Prateek Munjal, Tathagata Raha, Ronnie Rajan, Praveenkumar Kanithi2026-01-27
💬 NLP

Can Good Writing Be Generative? Expert-Level AI Writing Emerges through Fine-Tuning on High-Quality Books

यह अध्ययन प्रदर्शित करता है कि जबकि विशेषज्ञ लेखक शुरू में मानव-निर्मित पाठ को प्राथमिकता देते हैं, बड़े भाषा मॉडलों को पूर्ण लेखक कृतियों पर फाइन-ट्यून करना इस प्राथमिकता को उलट देता है, जिससे विशेषज्ञ एआई लेखन का पक्ष लेने लगते हैं और रचनात्मक श्रम की प्रकृति के संबंध में एक पहचान संकट उत्पन्न होता है।

Tuhin Chakrabarty, Paramveer S. Dhillon2026-01-27