Security and Privacy Prompts in the Wild: What Users Ask LLMs and How LLMs Respond
यह अध्ययन उपयोगकर्ता की पूछताछ को वर्गीकृत करने और LLM प्रतिक्रिया गुणवत्ता का मूल्यांकन करने के लिए WildChat डेटासेट से 14,727 वास्तविक दुनिया के सुरक्षा और गोपनीयता प्रॉम्प्ट का विश्लेषण करता है, जिससे यह पता चलता है कि हालांकि वाणिज्यिक मॉडल आम तौर पर ओपन-वेट मॉडलों से बेहतर प्रदर्शन करते हैं, फिर भी वे कभी-कभी विरोधाभासी सलाह देते हैं जो उपयोगकर्ताओं को गुमराह कर सकती है।