Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control
यह शोध पत्र रोबोटिक स्वास्थ्य सहायकों को नियंत्रित करने के लिए 72 लार्ज लैंग्वेज मॉडल्स की सुरक्षा का मूल्यांकन 270 हानिकारक निर्देशों के एक नए डेटासेट के माध्यम से करता है, जिससे यह पता चलता है कि आधे से अधिक मॉडल्स में उल्लंघन की उच्च दर है, प्रोप्राइटरी मॉडल्स ओपन-वेट मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करते हैं, और वर्तमान सुरक्षा स्तर सुरक्षित नैदानिक तैनाती के लिए अपर्याप्त बने हुए हैं।