प्रौद्योगिकी

Anthropic का खुलासा: Claude अपनी 26% AI रिसर्च खुद लीड करता है — 9 महीने पहले यह शून्य था

Adrian Kessler
हमें Google पर जोड़ें

एंथ्रोपिक (Anthropic) में होने वाले हर चार AI शोध कार्यों में से एक की अगुआई अब क्लॉड (Claude) करता है। यानी क्लॉड को सिर्फ़ मददगार के तौर पर नहीं लगाया जाता, न ही उसके काम की बाद में समीक्षा होती है — बल्कि एक उच्च-स्तरीय निर्देश से शुरू होकर पूरा काम अंत तक वही करता है, और आख़िर में एक इंसान नतीजे की जाँच करता है। नौ महीने पहले यह आंकड़ा एक प्रतिशत से भी कम था।

एंथ्रोपिक दो चीज़ों के बीच स्पष्ट रेखा खींचता है। जब क्लॉड किसी कार्य की अगुआई करता है, तो वह अधिकांश काम स्वतंत्र रूप से करता है; एक पर्यवेक्षक हर कदम पर मार्गदर्शन करने की बजाय आउटपुट की जाँच करता है। यह एंथ्रोपिक के कुल R&D के उस नब्बे प्रतिशत से अलग श्रेणी है जिसमें क्लॉड एक सहयोगी की भूमिका में होता है — इंसान दिशा तय करता है, क्लॉड खास हिस्सों को संभालता है। अगुआई करना ज़्यादा कठिन वर्गीकरण है। अब यह कंपनी के सभी AI शोधों का 26 प्रतिशत है, जिसे शोधकर्ताओं द्वारा उन कार्यों पर खर्च किए जाने वाले समय के आधार पर तौला गया है।

पैमाना ठोस है। एंथ्रोपिक के आंतरिक प्लेटफ़ॉर्म पर लगभग 30,000 क्लॉड एजेंट एक साथ चलते हैं, जो मॉडल प्रशिक्षण, मूल्यांकन, व्याख्या-क्षमता अनुसंधान और सुरक्षा विश्लेषण में काम करते हैं। अगस्त में, इन एजेंटों ने कुल मिलाकर एक अरब से अधिक निर्णय लिए। एंथ्रोपिक की रीयल-टाइम निगरानी प्रणाली ने उनमें से 0.002 प्रतिशत को — यानी हर 47,000 क्रियाओं में से लगभग एक को — निष्पादन से पहले रोक दिया। फिर एक ऑफ़लाइन परत ने समीक्षा के लिए साप्ताहिक रूप से लगभग 100,000 ट्रांसक्रिप्ट को चिह्नित किया, जिनमें से लगभग 50 को मानव के पास भेजा गया।

उस प्रणाली के भीतर सुरक्षा का एक मापने योग्य बजट है। जुलाई के एक सप्ताह के दौरान, एजेंटों को सुरक्षित रखने के लिए समर्पित कार्य ने सभी AI अनुसंधान और विकास कंप्यूट का छह प्रतिशत उपभोग किया, और AI-संचालित R&D द्वारा उपयोग किए जा रहे कंप्यूट का बारह प्रतिशत। एंथ्रोपिक का कहना है कि उसने रूढ़िवादी वर्गीकरण किया, समर्पित सुरक्षा क्लासिफायर को गिनती से बाहर रखा, जिससे संकेत मिलता है कि वास्तविक अनुपात और भी अधिक है।

इन सबके केंद्र में एक ज्ञानमीमांसीय समस्या है। एंथ्रोपिक के शोध में क्लॉड का योगदान आंशिक रूप से क्लॉड द्वारा ही मूल्यांकित किया जाता है। एक क्लॉड मॉडल क्लॉड के काम का आकलन करता है; पर्यवेक्षण के आंकड़े केवल एक आंतरिक प्लेटफ़ॉर्म को कवर करते हैं; और कंप्यूट वर्गीकरण क्लॉड मॉडलों पर निर्भर था जो अपने स्वयं के रनों का नमूना लेते और लेबल करते थे। किसी स्वतंत्र तीसरे पक्ष ने पद्धति का ऑडिट नहीं किया है। एंथ्रोपिक ने जो तीन आँकड़े प्रकाशित किए हैं वे सटीक हैं, लेकिन वे स्व-रिपोर्टेड सटीकता हैं — जो सत्यापित सटीकता से अलग चीज़ है।

एंथ्रोपिक का कहना है कि वह प्रक्रिया में बाहरी मूल्यांकनकर्ताओं को शामिल करना शुरू करेगा। अभी तक कोई नाम, कोई प्रारंभ तिथि, और अन्य AI प्रयोगशालाओं से कोई तुलनीय खुलासा सामने नहीं आया है। 26 प्रतिशत का आंकड़ा, जिस गति से यह बढ़ा है, उसे देखते हुए एक स्नैपशॉट है, सीमा नहीं।

टैग: , , , , ,

हमें Google पर जोड़ें

चर्चा

0 टिप्पणियाँ हैं।