Anthropic Claude Opus 5.5 niqobini ochdi, dasturlash, murakkab vazifalar va kompyuterdan foydalanishga yoʻnaltirilgan model
Batafsil
Olhar Digital
olhardigital.com.br

Anthropic Claude Opus 5.5 niqobini ochdi, dasturlash, murakkab vazifalar va kompyuterdan foydalanishga yoʻnaltirilgan model

Anthropic seshanba kuni (22-iyunda) Claude Opus 5.5 ni eʼlon qildi, bu Claude 5.5 seriyasining birinchi modeli hisoblanadi. Kompaniya bu yangi versiya dasturlash faoliyatlari, kompyuterlarni boshqarish va bilimli vazifalardagi ishlash samaradorligini oshirib, shu bilan birga xarajatlarni kamaytirish va javob berish tezligini oshirib, deb taʼkidlaydi.

Bundan tashqari, model yanada qattiqroq xavfsizlik mexanizmlari bilan jihozlandi. Ushbu himoya tizimlari kiberxavfsizlik va biologiya uchun moʻljallangan himoyalarni, prompt injeksiyasi hujumlariga qarshi toʻsiqlarni va sinov muhitlarida belgilangan chegaralarni buzish urinishlarini kamaytirishga qaratilgan choralar kabi elementlarni oʻz ichiga oladi.

Anthropic tomonidan oʻtkazilgan sinovlar davomida Opus 5.5 asosiy avtomatlashtirilgan moslashuvsinuvchi sinovidagi kompaniyaning hozirgacha eng yaxshi natijasiga erishdi. Kompaniya shuningdek, dasturlash, kompyuterlardan foydalanish va bilimli vazifalarda sezilarli taraqqiyot kuzatdi.

Dastlabki baholovchilardan biri bir kun ichida 680 ming qatorli kodni migratsiya qilishni yakunladi. Boshqa sinov ssenariysida model ilova sahifalarining yuklanish vaqtini amalga oshirilgan 40 ta urinishning 39 tasida kamaytirish qobiliyatini namoyish etdi.

Operatsion xarajatlarda ham sezilarli pasayish kuzatildi. Anthropic maʼlumotlariga koʻra, Opus 5.5 odatiy ish yuklarida ishlash uchun Opus 5 ga nisbatan 40% kamroq resurs talab qiladi va u 30% dan ortiq tez javoblar beradi.

Opus 5.5 kompaniya AI rivojlanishining «chegarasini sekinlashtirish» gʻoyasini himoya qilganidan keyingi birinchi chiqarilishdir, bunda xavfsizlik amaliyotlari modellar imkoniyatlarining rivojlanishiga mos ravishda saqlanib qoladi.

Ichki sinovlarda yangi model nazorat qilinadigan muhitlarda cheklovlarni Opus 5 yoki Claude Mythos 5.1 ga qaraganda taxminan 85% kamroq marta chetlab oʻtishga urinib koʻrdi. Aniqlangan barcha urinishlar past ogʻirlikdagi deb baholandi va model tomonidan oʻzi hisobot berildi.

Anthropic shuningdek, Opus 5.5 ning prompt injeksiyasi hujumlariga nisbatan yuqori chidamliligiga ega ekanligini taʼminlaydi. Kiberxavfsizlikka oid himoyalarni faollashtiruvchi talablar Claude Opus 4.8 ga yoʻnaltiriladi, biologiyaga oid soʻrovlar esa Opus 5 ga yuborilishi mumkin.

Dasturlashdagi Ishlash va Tashqi Baholashlar

Dastlabki sinovlar modelning dasturlashdagi ishlashini ham koʻrsatdi. GitHub mahsulot direktori Mario Rodriguez shuni taʼkidladi, bu model kompaniya tomonidan qayd etilgan eng kichik token hajmi va bosqichlar oraligʻida ishlatilib, VS Codeʼda Opus 5 dan koʻproq terminal vazifalarini bajarib, bosqichlarning yarmi dan kamroqidan foydalangan.

Deloitte Consulting tomonidan oʻtkazilgan baholashda model baʼzi vazifalarda Opus 5 dan ham ustun keldi. Deloitte Consulting CIO Carl Bennett shunday dedi: «Eng kam harakat talab qiladigan sozlamasida ham, Claude Opus 5.5 bizning kod koʻrib chiqishlarimizdagi maʼlum 72% xatoliklarni aniqladi, bu Opus 5 ning yuqori harakatdagi 56% ga qaraganda, kamroq yolgʻon signal va natija miqdori bilan erishildi.»

Anthropic model matnlarni ishlab chiqish usulini ham sozladi. Opus 5.5 eng dolzarb maʼlumotlarni javoblarning boshiga joylashtirishga ustuvorlik beradi, texnik jargonlardan kamroq foydalanadi va foydalanuvchi tomonidan taqdim etilgan yozishma yoʻriqnomalariga yaxshiroq rioya qiladi. Dastlabki baholovchilaridan biri bu oʻzgarishni quyidagicha xulosa qildi: «u men yozganimdek yozadi».

Hozirda Claude Opus 5.5 Anthropic platformalari, shuningdek, Amazon Web Services, Google Cloud va Microsoft Azure orqali mavjud. Ishlab chiqaruvchilar uni claude-opus-5-5 identifikatori yordamida Claude Platformada olishlari mumkin. Claude Sonnet 5.5 va Claude Haiku 5.5 yaqin haftalarda taqdim etiladi.

Mashhur