प्रौद्योगिकी

Gemini 4 Argon: Google की वापसी वाला मॉडल, जिसे अभी लगभग कोई इस्तेमाल नहीं कर सकता

Google DeepMind का नया मॉडल 10 लाख टोकन तक लिख सकता है और Google की अपनी रैंकिंग में सबसे ऊपर है, लेकिन सबसे पहले यह जाँचे-परखे साइबर रक्षकों को ही मिलेगा
Adrian Kessler
हमें Google पर जोड़ें

पिछले साल के ज़्यादातर समय Google की आर्टिफ़िशियल इंटेलिजेंस की कहानी इस बारे में थी कि उसने क्या लॉन्च नहीं किया। Gemini 4 Argon उसका जवाब है, और इसके बारे में सबसे ज़्यादा बताने वाली बात कोई बेंचमार्क स्कोर नहीं है। वह है मेहमानों की सूची। Google DeepMind का यह नया फ़्रंटियर मॉडल कंपनी के Fairwind Program के ज़रिए सबसे पहले जाँचे-परखे साइबर सुरक्षा रक्षकों के एक छोटे समूह को मिलेगा, और किसी को नहीं।

Argon लंबी अवधि के काम के लिए बनाया गया है: सॉफ़्टवेयर इंजीनियरिंग, क़ानूनी और वित्तीय शोध, और साइबर रक्षा। सबसे अहम तकनीकी बदलाव आउटपुट की लंबाई है: मॉडल अब एक ही बार में सैकड़ों हज़ार टोकन तर्क कर और लिख सकता है, जो किसी बड़े कोड माइग्रेशन को टुकड़ों में जोड़ने के बजाय अंत तक पूरा करने के लिए काफ़ी है।

Google का कहना है कि उसके हज़ारों इंजीनियर पहले से इसका इस्तेमाल कर रहे हैं। घोषणा में कंपनी बताती है कि Argon एजेंटों ने उसके डेटा सेंटरों में 300 TiB से ज़्यादा मेमोरी खाली की है और वे C और C++ कोड को मेमोरी-सुरक्षित भाषा Rust में पोर्ट कर रहे हैं, जिसका दायरा Fuchsia Zircon कर्नेल की 800,000 से ज़्यादा पंक्तियों तक जाता है। Google के ओपन-सोर्स वीडियो डिकोडर libgav1 पर Argon ने हाथ से ट्यून किए गए SIMD कोड की 32,000 पंक्तियों को सुरक्षित Rust में दोबारा लिखा, जो पिछले Rust पोर्ट से 2.7 गुना तेज़ चलता है।

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

आउटपुट की सीमा 64,000 टोकन से बढ़कर 10 लाख टोकन हो गई है। बेंचमार्क के आँकड़े Google के अपने हैं: DeepSWE v1.1 पर 77.9%, आर्थिक रूप से भारित ज्ञान-कार्य के Vals Index पर पहला स्थान, और लंबे वीडियो की समझ के लिए LVBench पर 91.7%। VentureBeat की गिनती के मुताबिक़, घोषित 18 बेंचमार्क में से 12 पर Argon साफ़ तौर पर आगे है, जबकि FrontierSWE v2 पर OpenAI का GPT-6 Astra अब भी उससे दस से ज़्यादा अंक आगे है। जब तक बाहरी परीक्षक मॉडल को ख़ुद नहीं चला पाते, तब तक ये दावे हैं, फ़ैसले नहीं।

साइबर सुरक्षा का यह ढाँचा ही इस रोक की वजह समझाता है। Google ने Argon को कमज़ोरियाँ ख़ुद खोजने, उनकी पुष्टि करने और उन्हें ठीक करने के लिए प्रशिक्षित किया है, और भरोसेमंद रक्षकों को साइबर सुरक्षा-सीमाएँ हटाकर एक संस्करण देगा। Wiz की Scan for Good पहल के ज़रिए इस मॉडल ने अस्पताल के सॉफ़्टवेयर में निजी डेटा उजागर करने वाली एक गंभीर ख़ामी पकड़ी, जिसे पहले के मॉडल नहीं पकड़ पाए थे। असहज करने वाली बात यह है कि जो मॉडल छेद भरने में इतना माहिर है, वह परिभाषा के हिसाब से छेद खोजने में भी उतना ही माहिर है।

इसलिए असली कहानी सुरक्षा उपायों की है। Google के मुताबिक़ Argon साइबर हमलों और रासायनिक, जैविक, रेडियोलॉजिकल या परमाणु हमलों में मदद करने से इनकार करता है, प्रॉम्प्ट इंजेक्शन के ख़िलाफ़ यह अब तक का उसका सबसे मज़बूत मॉडल है, और यह एक ऐसे मॉनिटर की निगरानी में चलता है जो इसकी विचार-श्रृंखला पर नज़र रखता है और उपयोगकर्ता के इरादे से आगे बढ़ते ही काम रोक देता है। Google अमेरिकी सरकार की स्वैच्छिक प्री-रिलीज़ मॉडल एक्सेस प्रक्रिया में भी हिस्सा ले रहा है।

तो आज Gemini 4 Argon का इस्तेमाल कौन कर सकता है? सिर्फ़ Fairwind समूह और Google की अपनी टीमें। डेवलपरों, कारोबारों या आम उपभोक्ताओं के लिए कोई तारीख़ तय नहीं है; पहुँच की शुरुआत पेड API ग्राहकों और Google AI Ultra सब्सक्राइबरों से होगी। शुरुआती क़ीमत प्रति 10 लाख इनपुट टोकन $2 और प्रति 10 लाख आउटपुट टोकन $10 है, जो बाद में बढ़कर $4 और $20 हो जाएगी।

मॉडल की घोषणा 30 सितंबर को कोरे कावुक्चुओग्लू ने की, जिन्होंने अगस्त में डेमिस हसाबिस के मुख्य कार्यकारी पद छोड़ने के बाद Google DeepMind की कमान संभाली। नवंबर 2025 में आए Gemini 3 के बाद यह Google का पहला नया फ़्लैगशिप मॉडल है, और इसकी असली परीक्षा कोई लीडरबोर्ड नहीं, बल्कि यह है कि बिना सुरक्षा-सीमाओं के जारी किया गया मॉडल उन्हीं हाथों में रहता है या नहीं, जिनके लिए वह बना था।

टैग: , , , , ,

हमें Google पर जोड़ें

चर्चा

0 टिप्पणियाँ हैं।