🤖 AI

SARLO-80: Worldwide Slant SAR Language Optic Dataset 80cm

यह शोध पत्र SARLO-80 को प्रस्तुत करता है, जो कि 72 देशों के अत्यंत-उच्च-रिज़ॉल्यूशन वाले कॉम्प्लेक्स-वैल्यूड स्लैंट-रेंज SAR इमेजरी, संरेखित ऑप्टिकल टाइल्स और प्राकृतिक-भाषा विवरणों के 119,566 ट्रिपलेट्स से बना एक बड़े पैमाने का, सार्वजनिक रूप से उपलब्ध मल्टीमॉडल डेटासेट है, जिसे भौतिक रूप से आधारित SAR-ऑप्टिकल-टेक्स्ट फाउंडेशन मॉडल्स को आगे बढ़ाने के लिए डिज़ाइन किया गया है।

Solène Debuysère, Nicolas Trouvé, Nathan Letheule, Elise Colin, Georgia Channing2026-06-19
🤖 AI

DeepSWIP: Quotient-WMC Counterfactuals for Neural Probabilistic Logic Programs

यह शोध पत्र DeepSWIP को प्रस्तुत करता है, जो एक न्यूरोसिंबोलिक फ्रेमवर्क है जो न्यूरल प्रेडिकेट्स (neural predicates) को कुशल वेटेड मॉडल काउंटिंग (weighted model counting) के लिए संभाव्य विकल्पों (probabilistic choices) में परिवर्तित करके DeepProbLog प्रोग्रामों के लिए सटीक सिंगल-वर्ल्ड काउंटरफैक्चुअल रीजनिंग (single-world counterfactual reasoning) को सक्षम बनाता है, जिससे महत्वपूर्ण इन्फरेंस स्पीडअप प्राप्त होता है और कॉज़ल एस्टिमेटर्स (causal estimators) में कैलिब्रेशन बायस (calibration biases) को ठीक किया जाता है।

Saimun Habib, Vaishak Belle, Fengxiang He2026-06-19
🤖 AI

LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents

LedgerAgent एक इन्फरेंस-टाइम विधि है जो ग्राहक-सेवा डोमेन में पॉलिसी-अनुपालन टूल-कॉलिंग एजेंटों को बेहतर बनाने के लिए एक अलग लेजर में टास्क स्टेट्स को बनाए रखती है ताकि सुसंगत निर्णय लेना सुनिश्चित किया जा सके और टूल निष्पादन से पहले पॉलिसी उल्लंघनों को सक्रिय रूप से रोका जा सके।

Md Nayem Uddin, Amir Saeidi, Eduardo Blanco, Chitta Baral2026-06-19
🤖 AI

How Do Instructions Shape Speech? Cross-Attention Attribution for Style-Captioned Text-to-Speech

यह शोध पत्र स्पीच डिफ्यूजन मॉडल्स के लिए अनुकूलित एक नवीन क्रॉस-अटेंशन एट्रिब्यूशन पद्धति प्रस्तुत करता है ताकि यह विश्लेषण किया जा सके कि स्टाइल-कैप्शन टोकन ध्वनिक आउटपुट को कैसे प्रभावित करते हैं, जिससे यह पता चलता है कि स्टाइल कंडीशनिंग शुरुआती ODE स्टेप्स और गहरे नेटवर्क लेयर्स में सबसे अधिक चयनात्मक होती है और मौलिक आवृत्ति (फंडामेंटल फ्रीक्वेंसी) एवं ऊर्जा के साथ दृढ़ता से सहसंबंधित होती है।

Nityanand Mathur, Hamees Sayed, Wasim Madha, Apoorv Singh, Sameer Khurana, Akshat Mandloi, Sudarshan Kamath2026-06-19
🤖 machine learning

How Transparent is DiffusionGemma?

यह शोध पत्र यह प्रदर्शित करता है कि हालांकि DiffusionGemma का निरंतर लेटेंट स्पेस (continuous latent space) शुरू में पारदर्शिता में बाधा डालता हुआ प्रतीत होता है, एक व्याख्या योग्य टोकन बॉटलनेक (interpretable token bottleneck) के माध्यम से इसके डिनोइजिंग स्टेप्स को मैप करने से परिवर्तनशील पारदर्शिता (variable transparency) में महत्वपूर्ण सुधार होता है और अद्वितीय तर्क संबंधी घटनाओं (reasoning phenomena) का पता चलता है, जो अंततः यह दर्शाता है कि मॉडल अपने ऑटोरेग्रेसिव समकक्ष की तरह ही मॉनिटरेबल बना रहता है।

Joshua Engels, Callum McDougall, Bilal Chughtai, Janos Kramar, Senthoran Rajamanoharan, Cindy Wu, Arthur Conmy, Asic Q C (…)2026-06-19
🤖 AI

R&B -- Rhythm and Brain: Cross-subject Decoding of Music from Human Brain Activity

यह अध्ययन एक अत्याधुनिक क्रॉस-सब्जेक्ट डिकोडिंग फ्रेमवर्क प्रस्तुत करता है जो CLAP लेटेंट रिप्रेजेंटेशन्स और वोक्सेल-वाइज एनकोडिंग मॉडल्स का लाभ उठाकर fMRI मस्तिष्क गतिविधि से संगीत उद्दीपनों को सटीक रूप से पुनः प्राप्त करता है, जो मौजूदा विधियों की तुलना में महत्वपूर्ण सुधार प्रदर्शित करता है और व्यक्तिगत अनुशंसाओं एवं चिकित्सा में संभावित अनुप्रयोगों को रेखांकित करता है।

Matteo Ferrante, Matteo Ciferri, Nicola Toschi2026-06-18
💬 NLP

Bandit-Based Prompt Design Strategy Selection Improves Prompt Optimizers

यह शोध पत्र OPTS को प्रस्तुत करता है, जो एक प्रॉम्प्ट ऑप्टिमाइज़ेशन फ्रेमवर्क है जो स्पष्ट, बैंडिट-आधारित तंत्र (विशेष रूप से थॉम्पसन सैंपलिंग) को लागू करके EvoPrompt जैसे मौजूदा ऑप्टिमाइज़र के प्रदर्शन को बढ़ाता है ताकि प्रॉम्प्ट डिज़ाइन रणनीतियों को प्रभावी ढंग से चुना और लागू किया जा सके, जिससे यह उन तरीकों से बेहतर प्रदर्शन करता है जो निहित रणनीति चयन पर निर्भर करते हैं।

Rin Ashizawa, Yoichi Hirose, Nozomu Yoshinari, Kento Uchida, Shinichi Shirakawa2026-06-18
💬 NLP

Assessment of Evolving Large Language Models in Upper Secondary Mathematics

यह अध्ययन प्रदर्शित करता है कि विकसित होते बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) गणितीय दक्षता में तेजी से उन्नत हुए हैं, जो मध्यम प्रदर्शन से लेकर फिनिश उच्च माध्यमिक मैट्रिकुलेशन परीक्षा में लगभग पूर्ण अंक प्राप्त करने तक प्रगति कर चुके हैं, जिससे गणित शिक्षा में सहायता के लिए शक्तिशाली उपकरण के रूप में उनकी क्षमता उजागर होती है।

Mika Setälä, Pieta Sikström, Ville Heilala, Tommi Kärkkäinen2026-06-18
🤖 AI

Superstudent intelligence in thermodynamics

यह शोध पत्र रिपोर्ट करता है कि OpenAI के o3 मॉडल ने एक कठिन विश्वविद्यालय ऊष्मागतिकी (thermodynamics) परीक्षा में अभूतपूर्व प्रदर्शन किया, जिसमें उसने सभी मानव छात्रों से अधिक अंक प्राप्त किए और एक महत्वपूर्ण मील का पत्थर स्थापित किया जहाँ मशीनों ने जटिल, रचनात्मक समस्या-समाधान कार्यों में मानवीय क्षमताओं को पीछे छोड़ दिया है।

Rebecca Loubet, Pascal Zittlau, Marco Hoffmann, Luisa Vollmer, Sophie Fellenz, Heike Leitte, Fabian Jirasek, Johannes Le (…)2026-06-18