प्रौद्योगिकी

Claude ने कुछ ही दिनों में OpenAI के सिस्टम में सेंध लगाई — और कठिन सवाल Anthropic के लिए हैं

Adrian Kessler
हमें Google पर जोड़ें

एक छोटी टीम ने एंथ्रोपिक के सबसे नए मॉडल को ओपनएआई के सामने के दरवाज़े पर लगाया और उसके अंदर चली गई। जो संस्करण ज़्यादातर लोग पढ़ रहे हैं — चतुर बाहरी लोग चैटजीपीटी के निर्माता को शर्मिंदा कर रहे हैं — वह मुद्दे को गलत समझता है। यह सेंध इस बात पर निर्भर नहीं थी कि ओपनएआई ने कुछ पैच करना भूल दिया था। यह उस पल पर निर्भर थी जब एंथ्रोपिक ने एक और सक्षम क्लॉड जारी किया। यही वह हिस्सा है जिस पर ठहरकर सोचना चाहिए: एक काम जो दिनों से अटका हुआ था, नया फ्लैगशिप आते ही खुद-ब-खुद हल हो गया।

इसमें शामिल लोग अपराधी नहीं थे। सुरक्षा स्टार्टअप हैकट्रॉन के शोधकर्ताओं ने ओपनएआई के अपने बग-बाउंटी प्रोग्राम के अंदर काम किया, कुछ साधारण वेब कमजोरियों को जोड़ा, ओपनएआई के कर्मचारियों के खातों तक पहुंचे, और एक आंतरिक कोड रिपॉजिटरी तक पहुंचे — फिर रुक गए, जो पाया उसे दर्ज किया, और एक मामूली इनाम लिया। उन्होंने सबूत के तौर पर एक हानिरहित निशान छोड़ा और आगे नहीं बढ़े। अपराध के रूप में पढ़ें तो यह एक गैर-घटना है। क्षमता परीक्षण के रूप में पढ़ें तो यह एक चेतावनी है।

यहां वह तंत्र है जिसे वायर कवरेज ने नज़रअंदाज़ कर दिया। टीम ने पहले यह काम क्लॉड ओपस 4.8 पर चलाया, जो सुरक्षा कार्यों के लिए तैयार किया गया संस्करण है, और यह कई सत्रों में अटका रहा। फिर एंथ्रोपिक ने ओपस 5 जारी किया। “ओपस 4.8 कई सत्रों में एक काम करने वाला शोषण तैयार करने में संघर्ष करता रहा,” हैकट्रॉन टीम ने लिखा। “ओपस 5 के रिलीज़ होने के कुछ ही घंटों में, हमने उसे वही समस्या दी और वह सफल रहा।” वेंचरबीट ने बताया कि नए मॉडल ने कुछ ही घंटों में एक अजीब चिप लक्ष्य के लिए एक काम करने वाला शोषण लिखा। उस दौरान ओपनएआई के बचाव में कुछ भी नहीं बदला। मॉडल बदला।

यह ठीक उसी तरह की छलांग है — एक सामान्य उपयोगकर्ता एक तैयार सब्सक्रिप्शन के साथ क्या कर सकता है, उसमें एक छलांग — जिसे पकड़ने और रोकने के लिए एंथ्रोपिक की अपनी सुरक्षा मशीनरी बनाई गई है। कंपनी अपने सबसे सक्षम साइबर मॉडल, माइथोस को निर्यात नियंत्रण और सत्यापित रक्षकों की एक छोटी सूची के पीछे रखती है, और इसे अपना सबसे मजबूत सुरक्षा मॉडल बताती है। यहां उसका कोई महत्व नहीं था। सार्वजनिक रूप से उपलब्ध स्तर ही काफी था। ग्रे स्वान के मुख्य कार्यकारी मैट फ्रेड्रिकसन ने टेकक्रंच से कहा, “$200 प्रति माह में, कोई भी इन उपकरणों का उपयोग कर सकता है और ओपनएआई जैसी कंपनी में हैक कर सकता है।”

यहीं पर जवाबदेही एंथ्रोपिक पर आकर टिकती है, न कि उसके प्रतिद्वंद्वी पर। एंथ्रोपिक ने अपनी पूरी पहचान सावधानी पर बनाई है — इसके मुख्य कार्यकारी, डारियो अमोदेई, प्रौद्योगिकी के “वास्तविक खतरों” के बारे में खुलकर बोलते हैं और उद्योग से धीमा चलने का आग्रह करते रहे हैं। एक सामान्य-रिलीज़ मॉडल जो प्रतिस्पर्धी प्रयोगशाला में घुसने की बाधा को मापने योग्य रूप से कम करता है, उस संदेश के लिए एक असहज प्रतिकार है। इसके लिए जवाब देने को कहने पर, कंपनी ने कुछ नहीं कहा; सीबीएस न्यूज ने बताया कि एंथ्रोपिक ने टिप्पणी के अनुरोध का जवाब नहीं दिया। ओपनएआई ने, अपनी ओर से, शोधकर्ताओं को धन्यवाद दिया, उन अनुमतियों को सीमित कर दिया जिनका हमलावरों ने दुरुपयोग किया था, और प्रभावित सत्रों को रद्द कर दिया।

विवरण लगभग सांसारिक हैं। अंदर जाने का रास्ता एक पुरानी इमेज-प्रोसेसिंग लाइब्रेरी थी जो डिस्कोर्स सॉफ्टवेयर के साथ बंडल थी जो ओपनएआई के सामुदायिक मंच को चलाती है; साइन-इन टोकन के दायरे में एक दूसरी चूक ने शोधकर्ताओं को एक समझौता किए गए सत्र के माध्यम से चैटजीपीटी और कोडेक्स के लिए कर्मचारी खातों में और निजी कोड तक पहुंचने दिया। पहली पकड़ से लेकर रिपॉजिटरी एक्सेस तक पूरी श्रृंखला में तीन दिन से भी कम समय लगा। ओपनएआई ने $6,500 का भुगतान किया। टीम का कहना है कि उसने पूरे प्रयास में क्लॉड का $3,000 से भी कम समय बिताया — दो महीने का काम, जिसमें से अधिकांश मानवीय था, अंत में एक ऐसी मशीन में समा गया जिसे अब किसी विशेषज्ञ की आवश्यकता नहीं थी।

दुर्लभ संसाधन जो किसी लक्ष्य की रक्षा करता था, वह कभी पैच नहीं था। यह विशेषज्ञ था जो खामियों को ढूंढ सकता था, उन्हें जोड़ सकता था और रास्ता देख सकता था — और वह महीने जो लगते थे। वह विशेषज्ञता अभी सस्ती हो गई है। इस बार जिस टीम ने ओपनएआई के कोड तक पहुंच बनाई, उसने एक रिपोर्ट दर्ज की और इनाम लिया। अगली टीम जो उसी सब्सक्रिप्शन पर उसी पैमाने को पार करेगी, वह ऐसा करने के लिए बाध्य नहीं है।

टैग: , , , , ,

हमें Google पर जोड़ें

चर्चा

0 टिप्पणियाँ हैं।