ओपनएआई ने 1 सितंबर को कहा कि उसका आगामी एस्ट्रा मॉडल पहला ऐसा तंत्र है जिसे कंपनी ने साइबर सुरक्षा क्षमता के गंभीर स्तर पर रखा है, इसलिए इसके जारी होने पर सबसे उन्नत सुरक्षा कार्य सीमित रहेंगे। कंपनी एस्ट्रा को जल्द उपलब्ध कराने की योजना बना रही है, लेकिन उन्नत साइबर काम पहले परीक्षकों के एक छोटे समूह तक सीमित होगा। इसके बाद रक्षकों के लिए डेब्रेक ब्लू कार्यक्रम के जरिए पहुंच बढ़ाई जाएगी।
ओपनएआई के तैयारी ढांचे के अनुसार, गंभीर वर्गीकरण का अर्थ है कि कोई मॉडल चरण-दर-चरण मानवीय निर्देश के बिना अनेक मजबूत प्रणालियों में पहले से अज्ञात कमजोरियां खोज सकता है और उनके लिए कारगर हमला विकसित कर सकता है, या केवल एक व्यापक लक्ष्य से नई और पूरी साइबर हमला रणनीति बनाकर उसे लागू कर सकता है। कंपनी के अनुसार स्वचालित मानकों, निजी परीक्षणों और विशेषज्ञों के आकलन ने एस्ट्रा में जीपीटी-5.6 सोल के मुकाबले बड़ा सुधार दिखाया।
कंपनी ने बताया कि ज्ञात कमजोरियों से हमले विकसित करने की क्षमता मापने वाले एक्सप्लॉइटबेंच में एस्ट्रा ने 100 प्रतिशत अंक हासिल किए। वी8 जावास्क्रिप्ट इंजन में हाल में सार्वजनिक हुई 20 गंभीर कमजोरियों के आंतरिक समूह पर उसने जीपीटी-5.6 सोल से कम आउटपुट टोकन इस्तेमाल करके मनचाहा कोड चलाने की अधिक दर हासिल की। परीक्षण के दौरान मॉडल ने दो अज्ञात कमजोरियां भी खोजीं और उन्हें एक हमले की कड़ी में इस्तेमाल किया; ओपनएआई उन्हें संबंधित रखरखावकर्ताओं को बता रहा है।
विशेषज्ञों की अलग परीक्षाओं में एस्ट्रा ने ब्राउजर पर हमले की ऐसी कड़ी बनाई जो सुरक्षित सैंडबॉक्स से बाहर निकली और एचटीएमएल फाइल खुलने के बाद मुख्य कंप्यूटर पर निर्देश चलाने लगी। उसने मजबूत ऑपरेटिंग सिस्टम की कई कमजोरियों को जोड़कर सामान्य उपयोगकर्ता से रूट स्तर तक अधिकार भी बढ़ाए। ओपनएआई ने कहा कि ये नतीजे डेब्रेक ब्लू पहुंच वाले एस्ट्रा के हैं, आम उपयोगकर्ताओं के लिए प्रस्तावित मूल व्यवस्था के नहीं।
ओपनएआई ने कहा कि उसने एस्ट्रा के विकास और जारी करने के कुछ हिस्सों में देरी की, जबकि हानिकारक अनुरोध ठुकराने का बेहतर प्रशिक्षण, प्रणाली स्तर के वर्गीकरण, खाते के जोखिम नियंत्रण और अनधिकृत गतिविधि रोकने वाली निगरानी जोड़ी गई। कंपनी के साइबर सुरक्षा को चकमा देने वाले परीक्षणों में एस्ट्रा ने 91.5 प्रतिशत अनुरोध ठुकराए, जबकि जीपीटी-5.6 सोल का आंकड़ा 59 प्रतिशत था। एक अलग हगिंग फेस घटना के बाद कुछ उन्नत प्रशिक्षण दो सप्ताह रुके, हालांकि एस्ट्रा उसमें शामिल नहीं था।
ओपनएआई ने माना कि ये सुरक्षा उपाय वैध रक्षात्मक काम को भी धीमा या बंद कर सकते हैं। चैटजीपीटी या कोडेक्स में चिह्नित कार्रवाई के लिए उपयोगकर्ता की समीक्षा मांगी जा सकती है, जबकि एपीआई के जरिए चल रहा कार्य पूरी तरह रुक सकता है। एक्सियोस के अनुसार सीमित शुरुआत अधिक स्वायत्त कृत्रिम बुद्धिमत्ता की व्यापक चुनौती दिखाती है: गंभीर कमजोरियां खोजने में रक्षकों की मदद करने वाली क्षमताएं हमलावरों को भी अधिक प्रभावी बना सकती हैं। कंपनी ने कोई निश्चित तारीख नहीं दी है और जारी करते समय सिस्टम कार्ड में विस्तृत सुरक्षा नतीजे देगी।
टिप्पणियाँ