दुनिया

ओपनएआई-हगिंग फेस उल्लंघन वास्तव में हमें क्या बताता है | व्याख्या की

OpenAI का कहना है कि उसके दो मॉडल – GPT-5.6 Sol और एक अप्रकाशित भाई – एक “बहुत अलग” मूल्यांकन वातावरण से बचे रहे, उन्होंने खुले इंटरनेट के लिए एक रास्ता ढूंढ लिया, और हगिंग फेस के उत्पादन बुनियादी ढांचे को तोड़ने के लिए चुराए गए क्रेडेंशियल्स के साथ-साथ शून्य-दिन के कारनामों की एक श्रृंखला का उपयोग किया।

परीक्षण को मॉडलों की अधिकतम सीमा निर्धारित करने के लिए डिज़ाइन किया गया था: यदि कुछ भी उन्हें रोक नहीं पाता तो वे कितना साइबर नुकसान कर सकते थे? इसलिए OpenAI ने सुरक्षा वर्गीकरण को बंद कर दिया जो आम तौर पर इस तरह के व्यवहार को रोक देगा। जो चीज़ उपलब्ध नहीं होनी चाहिए थी वह थी इंटरनेट तक पहुंच। हालाँकि, मॉडलों में अभी भी एक पाया गया: पैकेज-कैश प्रॉक्सी में एक अज्ञात दोष, जिसका उद्देश्य सैंडबॉक्स को सॉफ़्टवेयर रजिस्ट्रियों तक प्रतिबंधित, नियंत्रित पहुंच प्रदान करना था, जिसे वह नेटवर्क मशीन तक पहुंचने तक बायपास करता था। एक बार ऑनलाइन होने पर, उन्होंने तर्क दिया कि बेंचमार्क प्रतिक्रियाएँ हगिंग फेस पर बनी रह सकती हैं, और उन्हें प्राप्त करने के लिए तैयार रहें।

हगिंग फेस एक ओपन-वेट चीनी मॉडल, Z.ai के GLM 5.2 का उपयोग करके अपने सिरे पर उल्लंघन को पकड़ता है और शामिल करता है।

यह भी पढ़ें: कई दिनों के विरोध प्रदर्शन के बाद ज़ेलेंस्की ने सेना प्रमुख सिर्स्की को बर्खास्त कर दिया

कनाडाई कंप्यूटर वैज्ञानिक और ट्यूरिंग पुरस्कार विजेता जोशुआ बेंज़ियो ने इस प्रकरण को एक चेतावनी कहा, यह देखते हुए कि झूठे लक्ष्यों की ओर धोखा देने और धोखा देने के लिए डिज़ाइन किए गए एआई एजेंट अब केवल नियंत्रित परीक्षणों में ही नहीं, बल्कि प्रयोगशाला के बाहर भी दिखाई दे रहे हैं।

इस बीच, NYU के प्रोफेसर गैरी मार्क्स, जैसा कि उनकी आदत है, ने और अधिक संदेहपूर्ण अध्ययन की पेशकश की। “यह एक प्रशिक्षण अभ्यास था, वास्तविक जीवन की घटना नहीं।” उन्होंने कहा, परीक्षण के लिए सुरक्षा रेलिंग को जानबूझकर बंद कर दिया गया था, और सामान्य उपयोग में उन्होंने उल्लंघन को अच्छी तरह से रोका हो सकता है, जिससे उन्हें यह सुझाव मिला कि ओपनएआई का खाता वास्तविक हमले की रिपोर्ट की तुलना में सबसे खराब स्थिति की क्षमताओं को प्रदर्शित करने के लिए एक विपणन अभ्यास की तरह लगता है। फिर भी, मार्क्स ने दो बातें स्वीकार कीं: यह प्रकरण पुष्टि करता है कि एंथ्रोपिक का साइबर-केंद्रित मिथोस मॉडल बुरा नहीं है, और यह कि साइबर सुरक्षा पर अब इन क्षमताओं का दबाव वास्तविक है। उन्होंने यह भी कहा कि वही खुले उपकरण जो गले मिलने वाले चेहरों को उनके बचाव में मदद करते हैं, उनकी सुरक्षात्मक परतों को तोड़ सकते हैं, क्योंकि वे आसानी से आक्रामक हो सकते हैं।

यह भी पढ़ें: यूएस एच-1बी कार्यक्रम में प्रस्तावित परिवर्तन क्या हैं? | व्याख्या की

“सख्त” समस्या

जबकि आशावादी तेजी से सक्षम तर्क प्रणालियों को कठिन वैज्ञानिक और इंजीनियरिंग समस्याओं को हल करते हुए देखते हैं, संशयवादी महत्वपूर्ण अभिसरण को देखते हैं: लगभग किसी भी उद्देश्य को अपनाने वाली प्रणालियाँ उन रणनीतियों की खोज करती हैं जिनकी किसी को उम्मीद नहीं थी। यह चिंता एलिएज़र युडकोव्स्की द्वारा अपनी हालिया पुस्तक में उठाई गई है, यदि कोई इसे बनाता है, तो हर कोई मर जाता है: सुपरह्यूमन एआई हम सभी को क्यों मार डालेगाOpenAI के पहले o1 मूल्यांकन पर चर्चा।

आंतरिक कैप्चर-द-फ़्लैग परीक्षण में, लक्ष्य रहस्य वाला सर्वर बूट होने में विफल रहा। हार स्वीकार करने के बजाय, ओ1 ने एक असंबंधित भेद्यता पाई, मूल्यांकन की मेजबानी करने वाले बुनियादी ढांचे से समझौता किया, लक्ष्य सर्वर को फिर से शुरू किया, और रहस्य को कॉपी करने के लिए इसके आरंभीकरण निर्देशों को फिर से लिखा। इसने चुनौती का समाधान नहीं किया बल्कि उसे ख़त्म कर दिया। युडकोव्स्की के लिए, यह सबूत है कि इनाम-आकार की दृढ़ता, हैक करने के स्पष्ट इरादे के बिना, इस व्यवहार को उत्पन्न करती है: एक मॉडल को प्रशिक्षित करने का एक साइड इफेक्ट जब तक कि वह जीत न जाए, कोशिश करना बंद न करें।

यह भी पढ़ें: व्हाइट हाउस ब्रीफिंग में वेंस ने कहा कि ईरान युद्ध ‘हमेशा’ तक नहीं चलेगा

इससे पहले, एंथ्रोपिक के अपने अप्रकाशित क्लाउड माइथोस पूर्वावलोकन में कथित तौर पर ओपनबीएसडी के टीसीपी हैंडलिंग में 27 साल पुरानी खामी पाई गई थी, एक 16 साल पुराना एफएफएमपीईजी बग जो 5 मिलियन स्वचालित परीक्षणों से बच गया था, और 17 साल पुरानी फ्रीबीएसडी कर्नेल भेद्यता “बिना किसी मानव प्रयोग के शुरुआती काम में विकसित हुई थी।” हो गया,” $2,000।

चीन कोण

जब हगिंग फेस ने प्रमुख अमेरिकी मॉडलों के साथ उल्लंघन की जांच करने की कोशिश की, तो रेलिंग ने कर्मचारियों को अपने ट्रैफ़िक की जांच करने से रोक दिया क्योंकि मॉडल हमलावर और रक्षक के बीच अंतर नहीं बता सके। इसलिए हगिंग फेस ने फोरेंसिक कार्य करने के लिए एक ओपन-वेट चीनी मॉडल, जिपू के जीएलएम 5.2 का रुख किया।

यह भी पढ़ें: अमेरिका-इजरायल-लेबनान समझौते की मुख्य बातें

हगिंग फेस के सह-संस्थापक थॉमस वोल्फ के लिए, यह वास्तविक रास्ता है: चूंकि एआई सिस्टम गंभीर साइबर ऑपरेशन फैलाने में सक्षम हैं, रक्षकों को मुट्ठी भर बंद, यूएस-आधारित प्रयोगशालाओं से अनुमति पर्चियों के समान रूप से सक्षम उपकरणों तक तत्काल, व्यापक पहुंच की आवश्यकता है।

इस बीच, अमेरिका ने उन्नत चिप्स तक चीनी कंपनियों की पहुंच को प्रतिबंधित करने में कई साल बिताए हैं, यह शर्त लगाते हुए कि अमेरिकी प्रयोगशालाएं आगे रहेंगी। चीनी डेवलपर्स ने इसके बजाय दक्षता और खुली पहुंच की ओर झुकाव किया: डीपसेक, अलीबाबा के क्वेन और मूनशॉट एआई के किमी ने पश्चिमी प्रयोगशालाओं के साथ काफी अंतर को कम कर दिया है, यहां तक ​​​​कि वाशिंगटन ने राष्ट्रीय सुरक्षा के मामले में प्रतिस्पर्धा में वृद्धि की है। बीजिंग, अपनी ओर से, उस फ़्रेमिंग को निवारण के रूप में ख़ारिज कर देता है।

प्रोजेक्ट ग्लासविंग

एंथ्रोपिक का प्रोजेक्ट ग्लासविंग एक गठबंधन प्रयास है जो अप्रैल की शुरुआत में सीमा साइबर क्षमताओं को हमलावरों के हाथों में जाने से पहले रक्षकों के हाथों में लाने के लिए शुरू किया गया था। यह पहल अमेज़ॅन वेब सर्विसेज, एंथ्रोपिक, ऐप्पल, ब्रॉडकॉम, सिस्को, क्राउडस्ट्राइक, गूगल, जेपी मॉर्गन चेज़, द लिनक्स फाउंडेशन, माइक्रोसॉफ्ट, एनवीआईडीआईए और पालो ऑल्टो नेटवर्क्स को लॉन्च पार्टनर के रूप में एक साथ लाती है।

क्लाउड माइथोस प्रीव्यू एक सामान्य-उद्देश्य वाला, अप्रकाशित फ्रंटियर मॉडल है जो कोडिंग क्षमता के उस स्तर तक पहुंच गया है जहां यह सबसे कुशल मनुष्यों को भी सॉफ्टवेयर की खामियों को खोजने और उनका फायदा उठाने के लिए छोड़ सकता है, यही कारण है कि एंथ्रोपिक इसे खुले बाजार में जारी नहीं कर रहा है। कंपनी का कहना है कि वह क्लाउड माइथोस पूर्वावलोकन को आम तौर पर उपलब्ध कराने की योजना नहीं बना रही है, हालांकि इसका अंतिम लक्ष्य सुरक्षा सक्षम होने के बाद उपयोगकर्ताओं को बड़े पैमाने पर माइथोस-क्लास मॉडल को सुरक्षित रूप से तैनात करने देना है।

इस बीच, लगभग 50 स्टार्टअप भागीदार अपने स्वयं के कोडबेस को स्कैन करने के लिए क्लाउड माइथोस प्रीव्यू का उपयोग कर रहे हैं, और अब तक 10,000 से अधिक उच्च या गंभीर-गंभीर खामियों को बदल चुके हैं। जून में, मौजूदा साझेदारों, सुरक्षा उद्योग, ओपन-सोर्स अनुरक्षकों और अमेरिकी सरकार के साथ हफ्तों के सहयोग के बाद, कंपनी ने 15 से अधिक देशों में लगभग 150 नए संगठनों तक पहुंच का विस्तार किया, जिससे कुल साझेदार सूची लगभग 200 हो गई। हाल ही में, एंथ्रोपिक ने इस साल के अंत में सार्वजनिक होने की योजना की पुष्टि की।

छह से बारह महीनों के भीतर अन्य एआई कंपनियों के पास अपने स्वयं के मिथोस-क्लास सिस्टम होने की संभावना है, संभवतः दुरुपयोग को रोकने के लिए सुरक्षा उपायों के बिना। ग्लासविंग, वास्तव में, एक शर्त है कि रक्षकों को एक शुरुआत देने से यह पता लगाना मुश्किल हो जाता है कि जब पहला अपराध होता है तो क्या होता है।

पैसा भी यहीं जा रहा है. एंथ्रोपिक ने नकद दान के अलावा, मायथोस तक भुगतान पहुंच के साथ, ओपस के खुलने के बाद एक स्तर ऊपर, भागीदारों को मुफ्त क्रेडिट में $100 मिलियन देने का वादा किया है।

प्रकाशित – 24 जुलाई, 2026 प्रातः 08:41 बजे IST

Leave a Reply

Your email address will not be published. Required fields are marked *

Link Copied!