💻 computer science

TECCI: Tricky Edits of Collected and Curated Images

यह शोधपत्र TECCI को प्रस्तुत करता है, जो 7,550 क्यूरेटेड इमेज-एडिटिंग पेयर्स से बना एक चुनौतीपूर्ण नया बेंचमार्क है, जिसे विशेष रूप से जटिल स्थानिक और रचनात्मक कार्यों के लिए निर्देश पालन (instruction following), संपादन की न्यूनतमता (edit minimality) और दृश्य गुणवत्ता (visual quality) में वर्तमान टेक्स्ट-गाइडेड इमेज एडिटिंग मॉडलों की सीमाओं का व्यवस्थित रूप से मूल्यांकन करने और उन्हें उजागर करने के लिए डिज़ाइन किया गया है।

Aishwarya Agrawal, Roy Hirsch, Yasumasa Onoe, Sherry Ben, Jason Baldridge2026-06-02
💻 computer science

Distilling Neuro-Symbolic Programs into 3D Multi-modal LLMs

यह शोध पत्र APEIRIA को प्रस्तुत करता है, जो एक न्यूरो-सिम्बॉलिक 3D मल्टी-मोडल LLM है जो तीन-चरणीय पाठ्यक्रम के माध्यम से व्याख्या योग्य सिम्बॉलिक रीजनिंग पैटर्न को एक लचीले एंड-टू-एंड मॉडल में संकुचित (distill) करता है, जो पारदर्शी, मॉड्यूलर रीजनिंग और ओपन-वोकेबुलरी स्थानिक समझ के बीच के अंतर को प्रभावी ढंग से पाटता है।

Wentao Mo, Yang Liu2026-06-02
💬 NLP

Connecting the Dots: Benchmarking Reflective Memory in Long-Horizon Dialogue

यह शोध पत्र RefMem-Bench प्रस्तुत करता है, जो लंबी अवधि के संवादों में रिफ्लेक्टिव मेमोरी (reflective memory) का मूल्यांकन करने के लिए डिज़ाइन किया गया एक नया बेंचमार्क है, और REMIND फ्रेमवर्क का प्रस्ताव देता है ताकि मॉडल्स की प्रोग्रेसिव मीनिंग कंस्ट्रक्शन (progressive meaning construction) के माध्यम से खंडित संकेतों को उच्च-स्तरीय व्याख्याओं में संश्लेषित करने की क्षमता को बढ़ाया जा सके।

Jingjie Lin, Bingbing Wang, Zihan Wang, Zhengda Jin, Weiming Qiao, Jing Li, Ruifeng Xu2026-06-02
💬 NLP

Efficient RAG with Intent-Aware Retrieval and Semantics-Preserving Chunking

यह शोध पत्र InSemRAG प्रस्तुत करता है, जो एक रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है जो एक इंटेंशन-अवेयर रिट्राइवर और सेमैंटिक्स-प्रिजर्विंग चंकिंग को एक इटरेटिव मैकेनिज्म के भीतर संयोजित करके मल्टी-हॉप और एविडेंस-सेंसिटिव कार्यों पर प्रदर्शन को बढ़ाता है, जबकि कंप्यूटेशनल लेटेंसी को महत्वपूर्ण रूप से कम करने के लिए स्मॉल लैंग्वेज मॉडल्स का लाभ उठाता है।

Fachrina Dewi Puspitasari, Chaoning Zhang, Jiaquan Zhang, Zhicheng Wang, Hafiz Shakeel Ahmad Awan, Rizwan Qureshi, Jewon (…)2026-06-02
💬 NLP

Agentic Clustering: Controllable Text Taxonomies via Multi-Agent Refinement

यह शोध पत्र "एजेंटिक क्लस्टरिंग" (Agentic Clustering) पेश करता है, जो एक नवीन ढांचा है जो निश्चित प्रोग्रामेटिक पाइपलाइनों को एक ऑर्केस्ट्रेटर एलएलएम (orchestrator LLM) के नेतृत्व वाले मल्टी-एजेंट सिस्टम से बदल देता है ताकि टेक्स्ट टैक्सोनॉमी डिस्कवरी को विशिष्ट कॉर्पस संरचनाओं और उपयोगकर्ता बाधाओं के अनुरूप गतिशील रूप से अनुकूलित किया जा सके, जिससे सात बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Simon Löwe, Emily Silcock2026-06-02
⚡ electrical engineering

Beyond Sinusoids: A Morlet Wavelet Framework for Transformer Positional Encoding

यह शोधपत्र मोरलट पोजीशनल एनकोडिंग (MoPE) प्रस्तुत करता है, जो एक नवीन ढांचा है जो साइनुसोइडल और रोटरी पोजीशनल एनकोडिंग को एक सीखने योग्य वेवलेट-आधारित दृष्टिकोण के सीमित मामलों के रूप में एकीकृत करता है, जो स्थिति और स्थानीयता को एक साथ एनकोड करते हुए वेवलेट एडमिसिबिलिटी बाउंड्री की ओर अभिसरित होकर ट्रांसफॉर्मर मॉडल में बेहतर प्रदर्शन प्रदर्शित करता है।

Athanasios Zeris2026-06-02
💬 NLP

IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages

यह शोध पत्र इंडोबायस (IndoBias) का परिचय देता है, जो एक सांस्कृतिक रूप से आधारित बेंचमार्क है जिसमें इंडोनेशियाई और तीन स्थानीय भाषाओं में एलएलएम (LLM) पूर्वाग्रह का आकलन करने के लिए दोहरी मूल्यांकन ट्रैक की सुविधा है, जो यह प्रकट करता है कि मौजूदा मॉडल महत्वपूर्ण प्रतिनिधित्व संबंधी अन्याय प्रदर्शित करते हैं और कॉमन क्रॉल (Common Crawl) डेटा पर प्रीट्रेनिंग करना या स्थानीय भाषाओं को शामिल करना इन पूर्वाग्रहों को बढ़ा सकता है।

Ikhlasul Akmal Hanif, Muhammad Falensi Azmi, Filbert Aurelian Tjiaranata, Eryawan Presma Yulianrifat, Fajri Koto2026-06-02
💻 computer science

BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution

BenchEvolver एक समाधान-केंद्रित विकासवादी ढांचा (evolutionary framework) है जो संदर्भ समाधानों (reference solutions) को विकसित करके मौजूदा कोडिंग समस्याओं को स्वचालित रूप से कठिन, सत्यापन योग्य वेरिएंट में बदल देता है, जिससे LiveCodeBench-Plus जैसे उच्च-गुणवत्ता वाले बेंचमार्क बनते हैं जो मॉडल भेदभाव (model discrimination) को बहाल करते हैं और आत्म-सुधार के लिए प्रभावी प्रशिक्षण संकेत प्रदान करते हैं।

Yangzhen Wu, Aaron J. Li, Wenjie Ma, Li Cao, Ziheng Zhou, Mert Cemri, Shu Liu, Yuran Xiu, Chenxiao Yan, Haikun Zhao, Bin (…)2026-06-02
💬 NLP

Don't Read Everything: A Curvature-Conditioned Query for Linear Attention

यह शोध पत्र कर्वेचर-कंडीशन्ड क्वेरी (CCQ) को प्रस्तुत करता है, जो एक लागत प्रभावी तंत्र है जो रनिंग की कोवेरिएंस (running key covariance) से प्राप्त कर्वेचर अनुमान का उपयोग करके उच्च-घनत्व मेमोरी दिशाओं के साथ क्वेरीज को संकुचित (contracting) करता है, जिससे अंतर्निहित लीनियर अटेंशन बैकबोन को बदले बिना उपयोगी लक्ष्यों के विसरण (dilution) को कम करके लीनियर अटेंशन के इन-कॉन्टेक्स्ट रिट्रीवल और लॉन्ग-कॉन्टेक्स्ट प्रदर्शन को बढ़ाता है।

Dong Le, Thong Nguyen, Cong-Duy Nguyen, Anh Tuan Luu2026-06-02
💬 NLP

Challenger at MultiPRIDE: Is It Hate Speech or Reclaimed?

यह शोध पत्र मल्टीप्राइड (MultiPride) साझा कार्य के लिए एक गणनात्मक रूप से कुशल और व्याख्या योग्य दृष्टिकोण प्रस्तुत करता है जो अत्यधिक वर्ग असंतुलन (class imbalance) के बावजूद मजबूत प्रदर्शन प्राप्त करने के लिए घने अर्थपूर्ण एम्बेडिंग (dense semantic embeddings), क्लीनलैब-आधारित लेबल-नॉइज़ फ़िल्टरिंग और एक एमएलपी (MLP) क्लासिफायर को जोड़कर घृणास्पद भाषण (hate speech) को पुनरुद्धारित भाषा (reclaimed language) से अलग करता है।

Hadi Bayrami Asl Tekanlou, Mahdi Bakhtiyarzadeh, Jafar Razmara2026-06-02