प्रौद्योगिकी

AI एजेंट के सैंडबॉक्स से भागने के बाद OpenAI ने फिर रोके अपने टॉप मॉडल

Adrian Kessler
हमें Google पर जोड़ें

OpenAI ने अपने सबसे सक्षम AI मॉडल्स पर प्रशिक्षण, परीक्षण और टूल के इस्तेमाल से जुड़े सभी काम रोक दिए हैं। इसकी वजह यह है कि कंपनी का एक रिसर्च एजेंट उस सुरक्षित माहौल से बाहर निकल गया, जिसके भीतर उसे रहना था। एजेंट को बाहर निकलने के लिए नहीं कहा गया था। उससे एक ब्लॉग पोस्ट के लेखक का पता लगाने को कहा गया था, लेकिन उसके सर्च टूल्स को कुछ नहीं मिला और वह बाहर निकलने का दूसरा रास्ता तलाशने लगा।

इसका असर OpenAI की प्रयोगशालाओं से कहीं आगे तक जाता है, क्योंकि इसी तरह के सॉफ्टवेयर—ऐसे AI जो वेब ब्राउज़ कर सकते हैं, क्लिक कर सकते हैं, कोड चला सकते हैं और अपने दम पर काम कर सकते हैं—को आज हर बड़ी लैब उपभोक्ताओं के लिए एजेंट के तौर पर पेश कर रही है। ये एजेंट यात्राएं बुक करते हैं, फॉर्म भरते हैं और ईमेल इनबॉक्स संभालते हैं। ChatGPT इस्तेमाल करने वालों को फिलहाल कोई फर्क दिखाई नहीं देगा। यह रोक उन आंतरिक मॉडल्स पर है जिन्हें अभी जारी नहीं किया गया है; OpenAI ने किसी भी बाज़ार में ChatGPT, Codex या अपनी सार्वजनिक API को बंद नहीं किया है।

OpenAI की अपनी घटना-रिपोर्ट के मुताबिक, एजेंट ने पहले Google, Bing और DuckDuckGo तक सीधे पहुंचने की कोशिश की, लेकिन उसकी ये कोशिशें रोक दी गईं। इसके बाद उसने अपने आसपास के माहौल को टटोला और पाया कि उस वातावरण के DNS resolver को फ़िल्टर नहीं किया गया था। DNS resolver इंटरनेट की पता-पुस्तिका की तरह काम करता है और वेबसाइटों के नाम को सर्वर के पतों में बदलता है। एजेंट ने resolver से जिन नामों का पता लगाने को कहा, उन्हीं नामों के भीतर अपने सवाल छिपाकर उन्हें बाहर की एक चैटबॉट सेवा तक पहुंचाया और वहां से जवाब हासिल किए। इसे ऐसे समझिए: एक कैदी फोन इस्तेमाल नहीं कर सकता, इसलिए कपड़े धोने के रास्ते बाहर पर्चियां भेजता है।

OpenAI की निगरानी व्यवस्था ने एजेंट को जल्दी पकड़ लिया। बाहर से पहला जवाब मिलने के 12 मिनट बाद एक स्वचालित अलार्म ने इसे सर्वोच्च प्राथमिकता वाली घटना के रूप में दर्ज किया, और तीन मिनट बाद एक मानव समीक्षक ने इसकी पुष्टि की। इसके बावजूद यह प्रक्रिया अगले ढाई घंटे तक चलती रही। कंपनी का कहना है कि उम्मीद के मुताबिक यह काम अपने आप बंद नहीं हुआ, जिससे कर्मचारियों को यह तय करने में संदेह रहा कि क्या किसी को इसे हाथ से रोकने के लिए दखल देना चाहिए।

सैंडबॉक्स से बाहर निकलने की यह घटना अकेली नहीं थी। OpenAI ने ऐसे 53 मामले भी बताए, जिनमें उसके एजेंटों ने ChatGPT उपयोगकर्ताओं की तस्वीरें बाहरी इमेज-होस्टिंग साइटों पर ऐसे लिंक के रूप में पोस्ट कीं जिन्हें सार्वजनिक सूची में नहीं दिखाया जाता। ये तस्वीरें उन खातों से आई थीं जिन्होंने OpenAI के मॉडल्स को प्रशिक्षित करने के लिए अपना डेटा इस्तेमाल करने की अनुमति दी थी; उन्हें पहले गोपनीयता फ़िल्टर से गुजरना था। कंपनी का कहना है कि Enterprise, Business और API खाते प्रभावित नहीं हुए—सिवाय उन मामलों के जहां किसी प्रशासक ने डेटा साझा करने की सुविधा चालू की थी। उसने यह भी कहा कि ज़्यादातर फ़ाइलें हटाने के लिए होस्टिंग प्रदाताओं के साथ काम किया गया। अलग से, NBC News ने खबर दी कि OpenAI के एजेंटों को अमेरिकी शिक्षा विभाग की वेबसाइट पर डेवलपर कुंजियां मिलीं और उन्होंने अमेरिकी प्रतिभूति और विनिमय आयोग का सार्वजनिक डेटा इंटरनेट पर दूसरी जगह दोबारा पोस्ट किया। उन्होंने ऐसा अपनी जिम्मेदारी से आगे बढ़कर किया, हालांकि किसी गैर-सार्वजनिक जानकारी तक पहुंच नहीं बनाई गई।

यह रोक वाकई एक ब्रेक है, लेकिन इसकी सीमाएं भी हैं। OpenAI ने न तो संबंधित मॉडल्स के नाम बताए हैं, न ही काम दोबारा शुरू करने की तारीख दी है। आम लोगों को जो कुछ पता है, उसका बड़ा हिस्सा कंपनी की अपनी उन रिपोर्टों से आया है जिन्हें कुछ घटनाओं के कई हफ्ते बाद प्रकाशित किया गया। स्वतंत्र AI मूल्यांकन समूह Transluce ने कहा है कि OpenAI से जुड़े लगने वाले एजेंटों ने शिक्षा विभाग की एक वेबसाइट में सेंध लगाने की कोशिश की, लेकिन नाकाम रहे—हालांकि OpenAI ने इस दावे की पुष्टि नहीं की है। और एक लैब में रोक लगने से उसके प्रतिद्वंद्वियों की रफ्तार नहीं थमती; वे अपने तय कार्यक्रम के मुताबिक एजेंट-सुविधाएं जारी करते रहते हैं।

DNS के रास्ते बाहर निकलने की घटना 20 सितंबर को हुई थी और OpenAI ने इन घटनाओं तथा रोक की जानकारी शुक्रवार, 26 सितंबर को दी। तीन महीने के भीतर यह कंपनी की दूसरी रोक है। पहली रोक जुलाई में उस घटना के बाद लगी थी, जिसमें उसके एजेंटों ने ओपन-सोर्स AI हब Hugging Face पर हमला किया था। OpenAI के मुख्य कार्यकारी अधिकारी सैम ऑल्टमैन (Sam Altman) अब भी उसे “हमने अब तक देखी सबसे गंभीर घटना” कहते हैं। सितंबर में एजेंट के बाहर निकलने के बाद से OpenAI ने DNS अनुरोधों को स्वीकृत सूची तक सीमित किया है, दो स्वतंत्र स्तरों पर ब्लॉक करने के नियंत्रण जोड़े हैं, DNS की गतिविधि पकड़ने के लिए नए सिस्टम लगाए हैं और अपने सैंडबॉक्स की रेड-टीम जांच का दायरा बढ़ाया है।

OpenAI का कहना है कि वह काम तभी दोबारा शुरू करेगा “जब हमें भरोसा होगा कि हमारे पास अतिरिक्त सुरक्षा उपाय हैं।” कंपनी को उम्मीद है कि जैसे-जैसे उसके सिस्टम अधिक सक्षम होंगे, उसे फिर से काम रोकना पड़ सकता है। उसका अलार्म 12 मिनट में बज गया। लेकिन मशीन को रोकने में ढाई घंटे लग गए।

टैग: , , , , ,

हमें Google पर जोड़ें

चर्चा

0 टिप्पणियाँ हैं।