OpenAI o1 System Card
यह रिपोर्ट OpenAI के o1 और o1-mini मॉडलों के लिए सुरक्षा मूल्यांकनों, रेड टीमिंग और तैयारी ढांचे (Preparedness Framework) के आकलन का विवरण देती है, जो जेलब्रेक का प्रतिरोध करने और असुरक्षित सामग्री उत्पन्न करने में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए बड़े पैमाने पर सुदृढीकरण शिक्षण (reinforcement learning) और चेन-ऑफ-थॉट रीजनिंग का लाभ उठाते हैं, साथ ही बढ़ी हुई बुद्धिमत्ता से जुड़े जोखिमों को प्रबंधित करने के लिए मजबूत संरेखण (alignment) विधियों की आवश्यकता को भी रेखांकित करते हैं।