💬 NLP

From Associations to Activations: Comparing Behavioral and Hidden-State Semantic Geometry in LLMs

यह शोध पत्र प्रदर्शित करता है कि व्यवहार संबंधी समानता डेटा, विशेष रूप से मजबूर-विकल्प (forced-choice) कार्यों से प्राप्त डेटा, बड़े भाषा मॉडलों की छिपी हुई अवस्था की अर्थ संबंधी ज्यामिति (hidden-state semantic geometry) को प्रभावी ढंग से पुनः प्राप्त और पूर्वानुमानित कर सकता है, जो यह सुझाव देता है कि बाहरी व्यवहार संबंधी माप आंतरिक संज्ञानात्मक निरूपणों के बारे में महत्वपूर्ण जानकारी बनाए रखते हैं।

Louis Schiekiera, Max Zimmer, Christophe Roux, Sebastian Pokutta, Fritz Günther2026-02-17
💬 NLP

Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

यह शोध पत्र रीजन-टू-इमेज डिस्टिलेशन (Region-to-Image Distillation) का प्रस्ताव करता है, जो एक प्रशिक्षण-समय की विधि है जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल के एकल फॉरवर्ड पास में इटरेटिव "ज़ूमिंग" के सूक्ष्म-स्तरीय धारणा लाभों को आंतरिक रूप से समाहित करती है, जिससे फाइन-ग्रेंड विजुअल टास्क और सामान्य मल्टीमॉडल कॉग्निशन पर अत्याधुनिक प्रदर्शन प्राप्त करते हुए इन्फरेंस लेटेंसी को समाप्त किया जा सके।

Lai Wei, Liangbo He, Jun Lan, Lingzhong Dong, Yutong Cai, Siyuan Li, Huijia Zhu, Weiqiang Wang, Linghe Kong, Yue Wang, Z (…)2026-02-17
💬 NLP

MAPLE: A Sub-Agent Architecture for Memory, Learning, and Personalization in Agentic AI Systems

यह शोध पत्र MAPLE का प्रस्ताव करता है, जो एक नवीन सब-एजेंट आर्किटेक्चर है जो वर्तमान LLM एजेंटों की अनुकूलन क्षमता की सीमाओं को दूर करने के लिए मेमोरी, लर्निंग और पर्सनलाइजेशन को विशिष्ट, विशेष घटकों में अलग करता है, जो MAPLE-Personas बेंचमार्क पर पर्सनलाइजेशन स्कोर और ट्रेट इनकॉरपोरेशन में महत्वपूर्ण सुधार प्रदर्शित करता है।

Deepak Babu Piskala2026-02-17
💬 NLP

General learned delegation by clones

यह शोध पत्र SELFCEST को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो एक बेस लैंग्वेज मॉडल को डायनामिक रूप से समान-भार वाले समानांतर क्लोन (same-weight parallel clones) उत्पन्न करने और समन्वय करने के लिए एजेंटिक सुदृढीकरण लर्निंग (agentic reinforcement learning) का उपयोग करता है, जिससे मोनोलिथिक बेसलाइन की तुलना में जटिल तर्क कार्यों पर सटीकता-लागत दक्षता और सामान्यीकरण में सुधार होता है।

Darren Li, Meiqi Chen, Chenze Shao, Fandong Meng, Jie Zhou2026-02-17
💬 NLP

Directional Concentration Uncertainty: A representational approach to uncertainty quantification for generative models

यह शोध पत्र डायरेक्शनल कंसन्ट्रेशन अनसर्टेंटी (DCU) को प्रस्तुत करता है, जो एक लचीला, हीयुरिस्टिक-मुक्त ढांचा है जो von Mises-Fisher वितरण के माध्यम से आउटपुट एम्बेडिंग्स के ज्यामितीय फैलाव को मापकर जनरेटिव मॉडल अनसर्टेंटी को परिमाणित करता है, जिससे मौजूदा विधियों के तुलनीय या बेहतर अंशांकन प्रदर्शन प्राप्त होता है और मल्टी-मोडल एवं एजेंटिक कार्यों में प्रभावी ढंग से सामान्यीकरण होता है।

Souradeep Chattopadhyay, Brendan Kennedy, Sai Munikoti, Soumik Sarkar, Karl Pazdernik2026-02-17
💬 NLP

ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs

यह शोध पत्र ProMoral-Bench को प्रस्तुत करता है, जो एक नए यूनिफाइड मोरल सेफ्टी स्कोर (UMSS) का उपयोग करके चार LLM परिवारों के माध्यम से 11 प्रॉम्पटिंग रणनीतियों का मूल्यांकन करने वाला एक एकीकृत बेंचमार्क है, ताकि यह प्रदर्शित किया जा सके कि उच्च नैतिक सटीकता, सुरक्षा सुदृढ़ता और लागत-दक्षता प्राप्त करने में कॉम्पैक्ट, एक्सेम्प्लर-गाइडेड प्रॉम्प्ट्स जटिल मल्टी-स्टेज रीजनिंग की तुलना में बेहतर प्रदर्शन करते हैं।

Rohan Subramanian Thomas, Shikhar Shiromani, Abdullah Chaudhry, Ruizhe Li, Vasu Sharma, Kevin Zhu, Sunishchal Dev2026-02-17
💬 NLP

Artificial Organisations

यह शोध पत्र प्रस्तावित करता है कि मल्टी-एजेंट एआई सिस्टम कम्पार्टमेंटलाइज़ेशन (compartmentalization) और एडवर्सरियल रिव्यू (adversarial review) जैसे संस्थागत डिजाइन सिद्धांतों के माध्यम से विश्वसनीय सामूहिक व्यवहार प्राप्त कर सकते हैं, जो पर्सिवरेंस कंपोजिशन इंजन (Perseverance Composition Engine) के माध्यम से यह प्रदर्शित करता है कि ऐसे वास्तुशिल्प प्रतिबंध व्यक्तिगत रूप से अविश्वसनीय घटकों से भी ईमानदार परिणाम लागू कर सकते हैं।

William Waites2026-02-17
💬 NLP

Using Deep Learning to Generate Semantically Correct Hindi Captions

यह शोध एक डीप लर्निंग फ्रेमवर्क प्रस्तावित करता है जो Flickr8k डेटासेट से अर्थपूर्ण रूप से सटीक हिंदी इमेज कैप्शन उत्पन्न करने के लिए प्री-ट्रेंड CNN (विशेष रूप से VGG16), अटेंशन मैकेनिज्म और बिडायरेक्शनल LSTM को संयोजित करता है, जिससे BLEU-1 और BLEU-4 स्कोर क्रमशः 0.59 और 0.19 के साथ सर्वश्रेष्ठ प्रदर्शन प्राप्त होता है।

Wasim Akram Khan, Anil Kumar Vuppala2026-02-17
💬 NLP

Nanbeige4.1-3B: A Small General Model that Reasons, Aligns, and Acts

Nanbeige4.1-3B एक अग्रणी ओपन-सोर्स 3B-पैरामीटर भाषा मॉडल है जो उन्नत रिवॉर्ड मॉडलिंग और डीप सर्च ट्रेनिंग के माध्यम से सुदृढ़ तर्क, कोड जनरेशन और एजेंटिक टूल-यूज़ क्षमताओं को एकीकृत करता है, जो अपने पूर्ववर्तियों और काफी बड़े मॉडलों दोनों से बेहतर प्रदर्शन करता है।

Chen Yang, Guangyue Peng, Jiaying Zhu, Ran Le, Ruixiang Feng, Tao Zhang, Xiyun Xu, Yang Song, Yiming Jia, Yuntao Wen, Yu (…)2026-02-17
🧬 biology

Protect^*: Steerable Retrosynthesis through Neuro-Symbolic State Encoding

Protect* एक न्यूरो-सिम्बोलिक फ्रेमवर्क है जो स्वचालित नियम-आधारित तर्क और विशेषज्ञ बाधाओं को एकीकृत करके बड़े भाषा मॉडलों (LLMs) की रेट्रोसिंथेसिस में विश्वसनीयता को बढ़ाता है, ताकि जनरेटिव प्रक्रियाओं को रासायनिक रूप से संवेदनशील स्थलों से दूर निर्देशित किया जा सके, जिससे एरिथ्रोमाइसिन बी (Erythromycin B) जैसे जटिल अणुओं के लिए वैध और नवीन सिंथेटिक मार्गों की खोज संभव हो सके।

Shreyas Vinaya Sathyanarayana, Shah Rahil Kirankumar, Sharanabasava D. Hiremath, Bharath Ramsundar2026-02-17