Anthropic oʻzining Claude 5.5 oilasi ichidagi yangi oʻrta model boʻlgan Claude Sonnet 5.5 ni taqdim etdi. Kompaniyaning maʼlumotlariga koʻra, bu model Sonnet 5 ning tezligidan 30% dan ortiq ustunlikka ega va har bir vazifa uchun 30% gacha tejash imkonini berishi mumkin.
Bu chiqarilishning maqsadi kodni tuzatish, hujjatlar tayyorlash, taqdimotlar va jadvallar yaratish kabi aniq belgilangan faoliyatlarni optimallashtirishdir. Bundan tashqari, Sonnet 5.5 dizayn, hamkorlik va xavfsizlik kabi sohalarda yaxshilanishlarga ega boʻldi, shu bilan birga Opus 5.5 modeli yanada murakkab talablarga eʼtibor qaratib qoldi.
Narxlash nuqtai nazaridan, Sonnet 5.5 avvalgi versiya narxlarini saqlab qoldi: kirish tokenlari millioni uchun 2 AQSh dollari (taxminan 10,42 BRL), chiqish tokenlari millioni uchun 10 AQSh dollari (52,10 BRL) va kesh oʻqishlar millioni uchun 0,20 AQSh dollari (1,04 BRL).
Tokenlar — bu AI modellarining soʻrovni tushunish va javob yaratish uchun foydalanadigan eng kichik matn birliklaridir. Sonnet 5.5 odatda biror faoliyatni yakunlash uchun bu birliklarning kamroq miqdorini talab qilgani sababli, Anthropic har bir ish uchun 30% gacha xarajatni kamaytirishni rejalashtirmoqda. Bundan tashqari, model 30% dan ortiq tezlikda javoblar hosil qiladi.
Bu samaradorlik oshishi dasturlash sinovlarida sezildi. Buyruq satri orqali murakkab vazifalarni bajarishda AIʼning qobiliyatini oʻlchaydigan Terminal-Bench 4.0 da Sonnet 5.5 70,6%, Sonnet 5 ning 10,3% ga qaraganda natija koʻrsatdi.
Anthropic shuningdek, Sonnet 5.5 va Sonnet 5 oʻrtasidagi boshqa taqqoslash natijalarini baham koʻrdi. Taraqqiyotlarga qaramay, Anthropic Opus 5.5 hali ham kengaytirilgan fikrlashni talab qiladigan murakkab va ochiq ishlar boʻyicha katta kuchga ega ekanligini taʼkidlaydi. Biroq, baʼzi baholashlarda Sonnet 5.5 maksimal yuk ostida ishlaganda eng ilgʻor modelga yaqin natijalarga erishdi.
Evolyutsiya ayniqsa dasturlash sohasida seziladi, bunda Sonnet 5.5 kod bazalarini tez singdirib, vazifalarni kamroq bosqichlarda bajarishi mumkin. Sinovchilar modelning vositalardan foydalanishdagi samaradorligini ham taʼkidladilar.
Epic tomonidan oʻtkazilgan dastlabki sinovlarda Claude Sonnet 5.5 yuqori toifadagi model uchun kutilayotgan sifat standartiga erishdi. Epic Games operatsion direktori Daniel Vogel buni yozma xatda sharhlagan.
Yaxshilanishlar faqat kod bilan cheklanmaydi; Anthropic yaratish va bilim vazifalari boʻyicha ham samaradorlikni taʼkidlaydi, bu interfeyslar va taqdimotlarni qamrab oladi. Ichki sinovda modelga chorak materiallari, davlat korporatsiyasining transkripsiyalari va taqdimot modeli berildi. Natijada, ikki mutaxassis tomonidan yuborishga tayyor deb hisoblangan oʻn slaydlik operatsion koʻrib chiqish amalga oshirildi.
Slackning asosiy muhandisi Curtis Allen shunday dedi: «Promptlarimizni oʻzgartirmasdan, Claude Sonnet 5.5 Slackbotning barcha ichki baholashlarimizda Sonnet 5 dan yaxshiroq ishladi».
Qobiliyatning oshishi yangi himoya qatlamlari bilan birga keldi. Sonnet 5.5 Sonnet liniyasidagi ilk model boʻlib, u Anthropicning Opus 5.5 da qoʻllaniladigan kibersavolchilik himoyalari va zaxira mexanizmlarini oʻz ichiga oladi.
Himoyalar yuqori xavfli deb tasniflangan ssenariylarda AI dan foydalanishni cheklashga moʻljallangan qurilmalar sifatida ishlaydi. Kibersavolchilik kontekstida, kundalik ishlab chiqish faoliyati mavjud boʻlib qoladi, ammo xavfliroq soʻrovlar Sonnet 5 ga yoʻnaltirilishi mumkin.
Biologik sohada, himoyalar Sonnet 5 dagi kabi qolib, yuqori xavfli deb hisoblangan soʻrovlarga eʼtibor qaratadi. Sonnet 5.5 allaqachon Amazon Web Services, Google Cloud va Microsoft Azure kabi turli platformalarda mavjud. Yangi modellar gammasini toʻldirish uchun Claude Haiku 5.5 yaqin haftalarda ishga tushiriladi. Asl maqola dastlab Olhar Digitalda nashr etilgan.
