Evaluating Human-AI Safety: A Framework for Measuring Harmful Capability Uplift
यह स्थिति पत्र (position paper) तर्क देता है कि एआई सुरक्षा अनुसंधान को स्थिर बेंचमार्क से हटकर मानव-केंद्रित मूल्यांकनों की ओर स्थानांतरित होना चाहिए जो "हानिकारक क्षमता उत्थान" (harmful capability uplift)—अर्थात फ्रंटियर मॉडल्स द्वारा किसी उपयोगकर्ता की नुकसान पहुँचाने की क्षमता में होने वाली आंशिक वृद्धि—को मापते हैं, और यह इस मीट्रिक को एक मानक अभ्यास बनाने के लिए एक रूपरेखा और कार्रवाई योग्य चरण प्रदान करता है।