Anthropic ने प्रोग्रामिंग, जटिल कार्यों और कंप्यूटर उपयोग पर केंद्रित मॉडल Claude Opus 5.5 लॉन्च किया
और पढ़ें
Olhar Digital
olhardigital.com.br

Anthropic ने प्रोग्रामिंग, जटिल कार्यों और कंप्यूटर उपयोग पर केंद्रित मॉडल Claude Opus 5.5 लॉन्च किया

Anthropic ने मंगलवार (22) को Claude Opus 5.5 जारी किया, जो Claude 5.5 श्रृंखला का पहला मॉडल है। कंपनी का दावा है कि यह नया संस्करण प्रोग्रामिंग गतिविधियों, कंप्यूटर हेरफेर और ज्ञान कार्यों में प्रदर्शन को बेहतर बनाता है, साथ ही कम लागत और तेज प्रतिक्रिया समय भी प्रदान करता है।

इसके अलावा, मॉडल को अधिक कठोर सुरक्षा तंत्रों से लैस किया गया है। इन सुरक्षा उपायों में साइबर सुरक्षा और जीव विज्ञान के लिए बचाव, प्रॉम्प्ट इंजेक्शन हमलों के खिलाफ बाधाएं और परीक्षण वातावरण में स्थापित सीमाओं को दरकिनार करने के प्रयासों को कम करने के उपाय शामिल हैं।

Anthropic द्वारा किए गए परीक्षणों के दौरान, Opus 5.5 ने अपने मुख्य स्वचालित संरेखण परीक्षण में कंपनी का अब तक का सर्वश्रेष्ठ परिणाम हासिल किया। कंपनी ने प्रोग्रामिंग, कंप्यूटर उपयोग और ज्ञान कार्यों में भी उल्लेखनीय प्रगति देखी।

एक प्रारंभिक मूल्यांकनकर्ता ने एक कोड माइग्रेशन को एक दिन से भी कम समय में पूरा किया जिसमें 680 हजार लाइनें थीं। परीक्षण के एक अन्य परिदृश्य में, मॉडल ने किए गए 40 में से 39 प्रयासों में एप्लिकेशन के पृष्ठों के लोडिंग समय को कम करने की क्षमता प्रदर्शित की।

परिचालन लागत में भी उल्लेखनीय कमी आई है। Anthropic के अनुसार, सामान्य कार्यभार पर काम करने के लिए Opus 5.5 को Opus 5 की तुलना में 40% कम संसाधनों की आवश्यकता होती है, और यह 30% से अधिक तेजी से प्रतिक्रियाएँ उत्पन्न करता है।

Opus 5.5, Anthropic द्वारा 'एआई विकास की सीमा को धीमा करने' के सिद्धांत का समर्थन करने के बाद पहला लॉन्च है, जिसमें मॉडलों की क्षमताओं की प्रगति के अनुरूप सुरक्षा प्रथाओं को बनाए रखा गया है।

आंतरिक परीक्षणों में, नए मॉडल ने नियंत्रित वातावरण में प्रतिबंधों को Opus 5 या Claude Mythos 5.1 की तुलना में लगभग 85% कम बार दरकिनार करने की कोशिश की। पता लगाए गए सभी प्रयासों को कम गंभीरता वाला वर्गीकृत किया गया और मॉडल द्वारा स्वयं रिपोर्ट किया गया।

Anthropic यह भी सुनिश्चित करती है कि Opus 5.5 में प्रॉम्प्ट इंजेक्शन हमलों के प्रति अधिक प्रतिरोध है। साइबर सुरक्षा से संबंधित मांगों के लिए जो सुरक्षा को सक्रिय करते हैं, अनुरोधों को Claude Opus 4.8 पर पुनर्निर्देशित किया जाता है, जबकि जीव विज्ञान से संबंधित अनुरोधों को Opus 5 पर भेजा जा सकता है।

समान कहानियाँ

Anthropic ने खुलासा किया कि Claude नए एआई मॉडल के लिए 26% आर एंड डी कार्य का नेतृत्व करता है
और पढ़ें
olhardigital.com.br

Anthropic ने खुलासा किया कि Claude नए एआई मॉडल के लिए 26% आर एंड डी कार्य का नेतृत्व करता है

Anthropic ने डेटा जारी किया है जो दर्शाता है कि Claude मॉडल कंपनी के नए पीढ़ी के आर्टिफिशियल इंटेलिजेंस बनाने के लिए अनुसंधान और विकास के कार्य के 26% हिस्से के लिए जिम्मेदार है। इस प्रतिशत में उल्लेखनीय वृद्धि देखी गई, जो मार्च में दर्ज किए गए केवल 1% से बढ़कर हो गया, जैसा कि रॉयटर्स द्वारा बताया गया है।

अगस्त में, कंपनी ने देखा कि Anthropic में किए गए 90% से अधिक जांचों में मानव और एआई सिस्टम के बीच सहयोग शामिल था। हालांकि, संगठन इस बात पर जोर देता है कि Claude अभी भी मूल्यांकन की गई किसी भी गतिविधि में पूरी तरह से स्वायत्त रूप से कार्य नहीं करता है।

Claude की भागीदारी सूचकांक की गणना कैसे की गई

26% का संकेतक उन कार्यों को कवर करता है जहां Claude सामान्य निर्देश का पालन करते हुए अधिकांश काम कर सकता है, जबकि मनुष्य प्रक्रिया की निगरानी के लिए जिम्मेदार रहते हैं। Anthropic द्वारा उपयोग की गई पद्धति को Epoch AI द्वारा प्रदान की गई वर्गीकरण प्रणाली के आधार पर संरचित किया गया था, और प्राप्त परिणामों की बाद में मानवीय सत्यापन किया गया।

Anthropic ने चेतावनी दी कि जो मॉडल अपने स्वयं के विकास को तेज कर सकते हैं, वे मनुष्यों के लिए ऐसे सिस्टम को समझना या नियंत्रित करना मुश्किल बना सकते हैं।

इसके अतिरिक्त, Anthropic ने सूचित किया कि अगस्त में, उसकी मुख्य आंतरिक प्लेटफॉर्म पर इंजीनियरिंग और अनुसंधान कार्य करने वाले लगभग 30 हजार एआई एजेंट थे। इन एजेंटों द्वारा लिए गए प्रत्येक कार्य को लागू होने से पहले जांच से गुजरना पड़ता है। महीने भर में, इन एजेंटों ने एक अरब से अधिक निर्णय लिए, जिनमें से लगभग हर 47 हजार में से एक को अवरुद्ध कर दिया गया; कंपनी ने इन अवरुद्ध निर्णयों की प्रकृति निर्दिष्ट नहीं की।

सुरक्षा का मुद्दा भी Anthropic के कम्प्यूटेशनल प्रयास का एक हिस्सा लेता है। जुलाई के एक सप्ताह के दौरान, अनुसंधान और विकास के लिए समर्पित क्षमता का 6% सुरक्षा कार्यों के लिए आवंटित किया गया था। यदि हम केवल एआई द्वारा किए गए शोध पर विचार करें, तो यह सूचकांक 12% तक पहुंच गया। कंपनी इन आंकड़ों को रूढ़िवादी मानती है, क्योंकि क्षमताओं की प्रगति और सुरक्षा दोनों में योगदान देने वाले कार्यों को क्षमता कार्य श्रेणी के तहत दर्ज किया गया था।

नए मॉडल के विकास में एआई की प्रगति 'पुनरावर्ती स्व-सुधार' की अवधारणा पर बहस को बढ़ावा देती है, जो एक काल्पनिक परिदृश्य है जहां सिस्टम मानव भागीदारी में धीरे-धीरे कमी के साथ अपने भविष्य के संस्करणों में सुधार में योगदान दे सकते हैं। Anthropic ने निर्दिष्ट नहीं किया है कि यह स्थिति कितनी करीब है।

कंपनी उन्नत मॉडल पर काम करने वाली प्रयोगशालाओं में एआई के विकास की गति को जनता, तीसरे पक्ष और सरकारी निकायों को प्रदर्शित करने के लिए इन मेट्रिक्स को आवधिक रूप से जारी करने की योजना बना रही है।

मेट्रिक्स के मानकीकरण की संभावना

Anthropic ने घोषणा की कि कोई भी अग्रणी डेवलपर खुली पद्धति का उपयोग करके इन मापों को नियमित रूप से उपलब्ध करा सकता है। यह पहल एआई सिस्टम के अप्रत्याशित व्यवहार के बारे में बढ़ती चिंता के संदर्भ में सामने आई है। समानांतर रूप से, रॉयटर्स के अनुसार, OpenAI ने भी घोषणा की है कि वह अपने सिस्टम के किसी भी अनधिकृत या अप्रत्याशित व्यवहार पर नियमित रिपोर्ट प्रकाशित करना शुरू करेगा।

एंथ्रोपिक ने यूरोपीय निकायों के साइबर सुरक्षा परीक्षणों के लिए दबाव में मिथोस 5 एआई जारी किया
और पढ़ें
olhardigital.com.br

एंथ्रोपिक ने यूरोपीय निकायों के साइबर सुरक्षा परीक्षणों के लिए दबाव में मिथोस 5 एआई जारी किया

यूरोपीय संघ को एंथ्रोपिक द्वारा विकसित कृत्रिम बुद्धिमत्ता मॉडल मिथोस 5 तक पहुंच मिली है, जिसने कोड में खामियों का पता लगाने की अपनी क्षमता के कारण चिंताएँ पैदा की हैं। साइबर सुरक्षा एजेंसी ENISA ने कंपनी के साथ महीनों की बातचीत के बाद इस उपकरण पर परीक्षण शुरू कर दिए हैं।

यह पहुंच मॉडल के लॉन्च के बाद से लगाए गए पूर्व प्रतिबंधों के संदर्भ में हो रही है। इसके साथ, ENISA मिथोस 5 की साइबर सुरक्षा क्षमताओं का सीधे विश्लेषण कर सकती है। इसके अलावा, एजेंसी के पास पहले से ही OpenAI के उन्नत मॉडल हैं, जैसे GPT-5.6 Cyber और GPT-6-ASTRA।

मिथोस 5 में कंप्यूटर कोड में कमजोरियों की पहचान करने की कार्यक्षमता है। हालांकि यह क्षमता खामियों की खोज में सहायता कर सकती है, इसने साइबर हमलों में कृत्रिम बुद्धिमत्ता के उपयोग से जुड़े खतरों के बारे में भी आशंकाएँ जताई हैं।

संयुक्त राज्य अमेरिका और अन्य राष्ट्रों के अधिकारियों द्वारा व्यक्त की गई राष्ट्रीय सुरक्षा चिंताओं के कारण, मॉडल तक पहुंच प्रतिबंधित रही। प्रारंभ में, एंथ्रोपिक ने मिथोस 5 को अमेज़ॅन वेब सर्विसेज और जेपी मॉर्गन चेस सहित लगभग 50 कंपनियों और संगठनों के लिए उपलब्ध कराया था। जून में, इस संख्या को लगभग 150 संस्थाओं तक बढ़ा दिया गया था।

साइबर सुरक्षा अधिकारी मई से मिथोस 5 के लिए परीक्षण अनुमति प्राप्त करने हेतु एंथ्रोपिक के साथ बातचीत कर रहे थे। इससे पहले, यूरोपीय आयोग ने कंपनी के साथ मॉडल पर संवाद में होने की सूचना दी थी।

रिलीज़ का विवरण

यह रिलीज़ गुरुवार, 10 तारीख को औपचारिक रूप दी गई। ENISA को सिस्टम प्राप्त हुआ और इसी महीने परीक्षण शुरू कर दिए गए। यूरोपीय आयोग के डिजिटल मामलों के प्रवक्ता थॉमस रेग्नियर ने एक नोट में पुष्टि की कि यूरोपीय संघ की साइबर सुरक्षा एजेंसी, ENISA, ने मिथोस 5 तक पहुंच प्राप्त कर ली है और परीक्षण कर रही है।

ये परीक्षण ENISA को मिथोस 5 के कामकाज और साइबर सुरक्षा से संबंधित उसकी क्षमताओं की जांच करने में सक्षम बनाएंगे। कोड में कमजोरियों को इंगित करने की मॉडल की क्षमता इसकी उपयोग से जुड़ी चिंताओं का केंद्र बिंदु है।

प्रासंगिक बिंदुओं में से एक यह है कि मिथोस 5 एकमात्र उन्नत मॉडल नहीं है जो यूरोपीय एजेंसी के लिए सुलभ है; ENISA के पास पहले से ही OpenAI के सिस्टम थे, जैसे GPT-5.6 Cyber और GPT-6-ASTRA। एंथ्रोपिक के मॉडल तक पहुंच के साथ, एजेंसी अब एक अन्य उन्नत एआई का परीक्षण कर रही है जिसकी कोड में कमजोरियों का पता लगाने की योग्यता ने सुरक्षा संबंधी चिंताएँ पैदा की थीं और वितरण पर सीमाएँ लगाई थीं।

लोकप्रिय