A Red-Team Study of Anthropic Fable 5 & Opus 4.8 Models
यह रेड-टीम अध्ययन प्रकट करता है कि स्टेटिक ऑबफस्केशन (static obfuscation) के प्रति कड़े प्रतिरोध के बावजूद, एंथ्रोपिक के फ्रंटियर मॉडल्स फेबल 5 और ओपस 4.8 स्वचालित, पुनरावृत्ति वाले जेलब्रेक हमलों के प्रति विश्वसनीय रूप से असुरक्षित बने हुए हैं, जो मानवीय हस्तक्षेप के बिना सभी हानिकारक श्रेणियों में सैकड़ों पुष्ट हानिकारक आउटपुट उत्पन्न करते हैं।