पृष्ठभूमि
OpenAI ने ExploitGym में GPT-5.6 Sol और एक अधिक सक्षम, अंतःप्रयोगशाला मॉडल का परीक्षण किया, जो एक मानक है जो मापता है कि एआई एजेंट सॉफ्टवेयर कमजोरियों को कितनी अच्छी तरह से खोजते हैं और उनका शोषण करते हैं। अधिकतम क्षमता को मापने के लिए, OpenAI ने अपने उत्पादन सुरक्षा वर्गीकृतों को बंद करके परीक्षण चलाया। बाद में उसने कहा कि "इस मूल्यांकन के दौरान तैनाती सुरक्षा उपायों को जानबूझकर सक्षम नहीं किया गया था क्योंकि इसका उद्देश्य साइबर कमजोरियों का परीक्षण करना था।"
एजेंट्स ने अपने लक्ष्य तक पहुंचने का एक शॉर्टकट खोजा: Hugging Face तक पहुंचना ताकि वे परीक्षण के उत्तर खोज सकें। OpenAI के खुलासों पर आधारित Wikipedia का हिसाब कहता है कि 1,200 से अधिक एजेंट्स में से लगभग 95% ने आंतरिक मॉडल चलाया और लगभग 5% ने GPT-5.6 Sol चलाया।
