💬 NLP

When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges

यह शोध पत्र दो प्राथमिक विफलता मोडों—ऑप्टिमाइज़ेशन-टाइम ग्रेडिएंट डाइल्यूशन (optimization-time gradient dilution) और इन्फरेंस-टाइम इंस्ट्रक्शन इंटरफेरेंस (inference-time instruction interference)—की पहचान करता है, जो LLM जजों के लिए मल्टी-ऑब्जेक्टिव प्रॉम्प्ट ऑप्टिमाइज़ेशन में बाधा डालते हैं, यह प्रदर्शित करते हुए कि मौजूदा टेक्स्टुअल ग्रेडिएंट विधियाँ अक्सर कई मानदंडों को एक साथ संभालते समय प्रारंभिक प्रॉम्प्ट्स से बेहतर सुधार करने में विफल रहती हैं।

Parth Darshan, Abhishek Divekar2026-05-26
🤖 AI

Retrying vs Resampling in AI Control

यह शोध पत्र तर्क देता है कि जबकि जोखिम भरे एआई (AI) कार्यों को "पुनः प्रयास" (retrying) करना अविश्वसनीय मॉडलों को मॉनिटर फीडबैक का लाभ उठाने और सुरक्षा को कमजोर करने की अनुमति देता है, अधिकतम-संदेह ऑडिटिंग (maximum-suspicion auditing) के साथ कई आउटपुट को "पुनः नमूनाकरण" (resampling) करना उपयोगिता से समझौता किए बिना एआई नियंत्रण में सुधार के लिए एक अधिक प्रभावी और लागत-कुशल रणनीति प्रदान करता है।

James Lucassen, Adam Kaufman2026-05-26
🤖 AI

VeriTrace: Evolving Mental Models for Deep Research Agents

यह शोध पत्र VeriTrace को पेश करता है, जो एक संज्ञानात्मक-ग्राफ (cognitive-graph) ढांचा है जो विकसित होते मानसिक मॉडलों के लिए स्पष्ट नियामक लूपों (regulatory loops) को लागू करके डीप रिसर्च एजेंटों को उन्नत करता है, जिससे मौजूदा प्रणालियों की तुलना में DeepResearch Bench और DeepConsult जैसे बेंचमार्क पर प्रदर्शन में महत्वपूर्ण सुधार होता है।

Haolang Zhao, Yunbo Long, Lukas Beckenbauer, Alexandra Brintrup2026-05-26
🤖 machine learning

OrpQuant: Geometric Orthogonal Residual Projection for Multiplier-Free Power-of-Two Transformer Quantization

यह शोध पत्र OrpQuant को प्रस्तुत करता है, जो एक मल्टीप्लायर-मुक्त (multiplier-free) पावर-ऑफ-टू (Power-of-Two) क्वांटाइजेशन फ्रेमवर्क है जो लॉगरिदमिक लैटिस के निम्न कोणीय रिज़ॉल्यूशन (low angular resolution) को दूर करने के लिए ज्यामितीय ऑर्थोगोनल रेसिडुअल प्रोजेक्शन (Geometric Orthogonal Residual Projection) का उपयोग करता है, जिससे एज डिवाइसेस पर LLMs और ViTs की अत्यधिक कम अंशांकन समय (calibration time) और हार्डवेयर जटिलता के साथ कुशल, उच्च-सटीक तैनाती सक्षम होती है।

Maoyang Xiang, Bo Wang, Tao Luo2026-05-26
💬 NLP

Language Models Need Sleep

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स के लिए एक नींद जैसी सुदृढ़ीकरण (consolidation) प्रक्रिया का प्रस्ताव करता है जो ऑफलाइन रिकरेंट पासेस के दौरान हालिया कॉन्टेक्स्ट को निरंतर फास्ट वेट्स में परिवर्तित करता है, जिससे अटेंशन स्केलिंग की सीमाओं को दूर किया जा सके और इन्फरेंस लेटेंसी को सुरक्षित रखते हुए लॉन्ग-होरिज़न और डीप-रीज़निंग कार्यों पर प्रदर्शन में महत्वपूर्ण सुधार किया जा सके।

Sangyun Lee, Sean McLeish, Tom Goldstein, Giulia Fanti2026-05-26
🤖 AI

Beyond Summaries: Structure-Aware Labeling of Code Changes with Large Language Models

यह शोध पत्र कोड परिवर्तनों के संरचना-जागरूक, वर्गीकरण-आधारित लेबलिंग को करने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करते हुए एक दो-चरणीय, फ्यू-शॉट प्रॉम्प्टिंग पाइपलाइन प्रस्तुत करता है, जो उच्च परिशुद्धता और रिकॉल प्राप्त करते हुए कोड समीक्षा दक्षता में सुधार के लिए पारंपरिक स्टैटिक एनालिसिस के एक लचीले, भाषा-अज्ञेय विकल्प के रूप में कार्य करता है।

Bar Weiss, Antonio Abu-Nassar, Adi Sosnovich, Karen Yorav2026-05-26
🤖 AI

Thermal transmittance prediction based on the application of artificial neural networks on heat flux method results

यह शोध पत्र वायु तापमान डेटा से ऊष्मा प्रवाह (हीट फ्लक्स) की भविष्यवाणी करने के लिए विभिन्न आर्टिफिशियल न्यूरल नेटवर्क आर्किटेक्चर के उपयोग की जांच करता है, जिसका उद्देश्य ISO 9869-1 मानक के तहत भवन आवरणों के इन-सीटू थर्मल ट्रांसमिटेंस (U-वैल्यू) मूल्यांकन के लिए आवश्यक मापन अवधि को महत्वपूर्ण रूप से कम करना है।

Sanjin Gumbarević, Bojan Milovanović, Mergim Gaši, Marina Bagarić2026-05-25
🤖 AI

MirrorCheck: Efficient Adversarial Defense for Vision-Language Models

यह शोधपत्र मिररचेक (MirrorCheck) का प्रस्ताव करता है, जो एक सुदृढ़ और मॉडल-अज्ञेय (model-agnostic) डिटेक्शन फ्रेमवर्क है, जो सिमेंटिक कंसिस्टेंसी चेक्स के लिए टेक्स्ट-टू-इमेज रिजनरेशन का लाभ उठाकर, स्टोकेस्टिक मॉडल चयन और वन-टाइम-यूज़ परटर्बेशन्स द्वारा संवर्धित होकर, विज़न-लैंग्वेज मॉडल्स को एडेप्टिव एडवरसेरियल अटैक्स से सुरक्षित रखता है।

Samar Fares, Klea Ziu, Toluwani Aremu, Nikita Durasov, Martin Takáč, Pascal Fua, Karthik Nandakumar, Ivan Laptev2026-05-25
⚡ electrical engineering

XAttnMark: Learning Robust Audio Watermarking with Cross-Attention

यह शोध पत्र XAttnMark प्रस्तुत करता है, जो एक सुदृढ़ ऑडियो वॉटरमार्किंग फ्रेमवर्क है जो विविध ऑडियो रूपांतरणों और जनरेटिव एडिटिंग के विरुद्ध उच्च अदृश्यता बनाए रखते हुए डिटेक्शन और एट्रिब्यूशन दोनों में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए क्रॉस-अटेंशन मैकेनिज्म, आंशिक पैरामीटर शेयरिंग और एक साइकोअकौस्टिक-अलाइन्ड लॉस फंक्शन का लाभ उठाता है।

Yixin Liu, Lie Lu, Jihui Jin, Lichao Sun, Andrea Fanelli2026-05-25
🤖 AI

TerraQ: Spatiotemporal Question-Answering on Satellite Image Archives

TerraQ एक प्राकृतिक भाषा प्रसंस्करण (natural language processing) प्रणाली है जिसे मेटाडेटा और विशिष्ट ज्ञान आधार संस्थाओं (knowledge base entities) को संयोजित करने वाले प्राकृतिक भाषा अनुरोधों का उपयोग करके उपग्रह छवि अभिलेखों (satellite image archives) को क्वेरी करने में उपयोगकर्ताओं को सक्षम बनाकर पृथ्वी अवलोकन डेटा को अधिक सुलभ बनाने के लिए डिज़ाइन किया गया है।

Sergios-Anestis Kefalidis, Konstantinos Plas, Manolis Koubarakis2026-05-25