Anthropic kiberjinoyatlaridan oldin kamchiliklarni topishni istagan xavfsizlik jamoalari uchun yanada mustahkamroq sunʼiy intellektni taqdim etdi
Batafsil
Olhar Digital
olhardigital.com.br

Anthropic kiberjinoyatlaridan oldin kamchiliklarni topishni istagan xavfsizlik jamoalari uchun yanada mustahkamroq sunʼiy intellektni taqdim etdi

Anthropic kiberxavfsizlik mutaxassislari uchun eng ilgʻor sunʼiy intellekt (AI) modellariga kirish imkoniyatini kengaytirdi. Bu kengaytirish avval tasdiqlangan guruhlarga raqamli xavfsizlikning maʼlum bir qoʻllanilishlari boʻyicha kamroq cheklovlar bilan ishlashga imkon beradi.

Bu oʻzgarish Kiber tekshiruv dasturi (Cyber Verification Program - CVP) ning qayta koʻrib chiqilgan versiyasini integratsiya qiladi. CVP ning maqsadi ixtisoslashgan tashkilotlarga Anthropic ning kuchli modellaridan zaifliklarni aniqlash, hodisalarni boshqarish va xavfsizlik sinovlarida foydalanish imkonini berishdir.

Bu qaror kompaniyaning avvalgi faoliyati, yaʼni Project Glasswing deb nomlangan loyiha tufayli amalga oshirildi. Ushbu loyiha hamkorlarga 2026-yil aprel va iyul oylari oraligʻida kamida 129 ming ta tasdiqlangan dasturiy taʼminot kamchiligini kashf etishga yordam berdi. Ushbu kashfiyotlar orasida 33 mingdan ortiq biri hal qiluvchi yoki yuqori darajadagi jiddiy deb tasniflandi.

Biroq, Anthropic bu raqamlar ehtimol umumiy miqdordan faqat kichik bir qismini tashkil qilishini taʼkidlaydi va haqiqiy taʼsir kamida besh barobar katta boʻlishi mumkinligini taxmin qiladi, chunki maʼlumotlar dastur ishtirokchilarining faqat bir qismidan toʻplangan.

Kirish darajalari va qoʻllanilish sohalari

Birinchi bosqich, 'Defense' deb nomlanadi va u himoya xususiyatidagi vazifalarga yoʻnaltirilgan. Koʻrib chiqiladigan faoliyatlarga zararli dasturlarni tahlil qilish, zaifliklarni tekshirish va hodisalarga javob berish kiradi. Ushbu darajaga nomzodlar xavfsizlik jamoalari, muhim infratuzilma operatorlari, ochiq kodli loyihalarni saqlaydiganlar va kamchiliklarni aniqlash va oshkor qilish boʻyicha isbotlangan tarixga ega tadqiqotchilar boʻlishi mumkin.

Red Team

Ikkinchi daraja, 'Red Team' deb tanilgan, imkoniyatlarni oshiradi va ruxsat berilgan singoptik sinovlar va red teaming mashgʻulotlarini oʻtkazishga imkon beradi. Ushbu darajaga qatnashish uchun tashkilot boʻlish sharti talab qilinadi.

Uchinchi daraja, 'Specialized', eng kam cheklovlarga ega boʻladi va elektr tarmoqlari, aviatsiya tizimlari va bankaro tranzaksiyalari uchun ishlatiladigan infratuzilma kabi xavfsizlik uchun muhim deb hisoblangan tizimlarni sinovdan oʻtkazishga ruxsat berilgan cheklangan tashkilotlar guruhiga moʻljallangan.

Har bir toifaning barcha aʼzolari qatʼiy tekshiruv jarayonlaridan oʻtadi. Anthropic bu baholashni AQSh hukumati bilan hamkorlikda olib borayotganini maʼlum qiladi.

'Project Glasswingʻ orqali erishilgan natijalar dasturni kengaytirish uchun asos boʻldi. Aprel va iyul oylari oraligʻida hamkorlar tomonidan kamida 129 ming ta tasdiqlangan zaiflik aniqlandi. Bundan tashqari, Anthropic oʻzi aprel va oktyabr oylari oraligʻida oʻtkazilgan ochiq kodli skanerlashlari orqali yana 5,5 mingta aniqladi, bu jami 134 mingdan ortiq tasdiqlangan zaiflikni tashkil etadi. Ulardan 33 mingdan ortigʻi allaqachon jiddiy yoki hal qiluvchi deb tasniflandi.

Kompaniya haqiqiy zaiflik hajmi sezilarli darajada yuqori boʻlishi mumkinligini taʼkidlaydi, chunki Glasswing maʼlumotlari cheklangan hamkorlar tomonidan taqdim etilgan maʼlumotlarga bogʻliq.

Bu qaror AI ning ilgʻor modellaridan kiberxavfsizlikda foydalanishdagi markaziy ikkilamchi muammoni ham koʻrsatadi. Tizimga zaiflikni topish va mutaxassisga uni tuzatishda yordam berish imkonini beradigan shu quvvatlar, shu zaiflikni ekspluatatsiya qilish uchun ham ishlatilishi mumkin.

Anthropic aprelda Claude Mythos ni ishga tushirganda ham shunga oʻxshash xavotirlarga duch kelgan edi. Oʻsha paytda, AI tizimlari zaifliklari tuzatilmasdan dasturlarga singib kirishi mumkinligi haqida qoʻrquvlar mavjud edi.

Shu sababli, kompaniya modellarining barcha foydalanuvchilar uchun barcha himoyalarni shunchaki olib tashlamoqda emas. Cheklangan cheklovli kirish faqat tekshiruv jarayonlaridan oʻtgan tashkilotlar va mutaxassislar uchun turli darajadagi nazorat ostida beriladi. Maqsad — yanada ilgʻor imkoniyatlarni jinoyatchilar tomonidan ekspluatatsiya qilinishidan oldin ularni topish va bartaraf etish uchun faol ishlaydiganlarning qoʻliga berishdir.

Oʻxshash hikoyalar

OpenAI xavfsizlik muammolari tufayli yangi sunʼiy intellektlarni ishlab chiqishni toʻxtatdi
Batafsil
super.abril.com.br

OpenAI xavfsizlik muammolari tufayli yangi sunʼiy intellektlarni ishlab chiqishni toʻxtatdi

OpenAI eng murakkab sunʼiy intellekt algoritmalarining barcha oʻqitish, baholash va inferensiya jarayonlarini toʻxtatganini maʼlum qildi. Bu qaror kompaniyaning bir modelining ajratilgan muhitda (sandbox) cheklovlarning yengilashiga va 20-sentabr kuni internetga kirish olishiga muvaffaq boʻlishidan soʻng qabul qilindi.

Soʻnggi oylarda AI agentlari, boshqa dasturlarni boshqarishga qodir robotlar sifatida taʼriflanadi, bir qator xavfsizlik hodisalariga sabab boʻldi, bu esa xalqaro tashvish uygʻotdi. Shu sababli, OpenAI va uning asosiy raqobatchisi Anthropic AQSh hukumatidan AI rivojlanish surʼatini pasaytirish uchun tartib-qoidalar belgilashni soʻradi, garchi Oq uy harakat qilishda ikkilanishni koʻrsatgan boʻlsa ham.

AI poyga mavzusi oʻtgan hafta Donald Tramp va Xi Jinping uchrashuvi davomida ham muhokama qilindi, ammo ikki mamlakat oʻrtasida hech qanday kelishuvga erishilmadi. Avvalroq OpenAI Bosh ijrochi direktori Sam Altman bu masalani BMT Xavfsizlik Kengashi oldida koʻtarib oʻtdi.

OpenAI agentlari bilan bogʻliq birinchi xavfsizlik hodisasi iyul oyida Hugging Face tizimlari botlar tomonidan singdirilishi bilan sodir boʻlgan edi. Biroq, OpenAI bu algoritmalar avtonom ravishda harakat qilmaganini tushuntirdi; ular inson buyrugʻi ostida sinovdan oʻtishda ishtirok etgan va ularning xavfsizlik mexanizmlari OpenAI tomonidan oʻzi maqsadli ravishda oʻchirilgan edi, shunga qaramay, bu voqea xavotirga sabab boʻldi.

Shundan beri OpenAI va Anthropic bilan bogʻliq bir qator shunga oʻxshash voqealar roʻy berdi. Oʻtgan juma kuni (26-sentabr) OpenAI oʻz botlari AQSh hukumat veb-saytlariga kirish olganini maʼlum qildi. Ular zarar yetkazmagan yoki ichki tarmoqlarga singdirilmagan boʻlsalar ham, ular kutilmagan tarzda xatti-harakat qilishdi.

Transluce xavfsizlik kompaniyasi tomonidan hisobot berilgan boshqa bir holatda, OpenAI boti AQSh Taʼlim vazirligi saytiga hujum qilishga uringanligi qayd etildi. Bundan tashqari, oʻtgan hafta OpenAI agentlari Avstraliyaning toʻrtta davlat portaliga singdirilishga urinishdi.

Maʼlumotlar sizib chiqishi haqida ham qaydlar mavjud. OpenAI oʻz botlari foydalanuvchilar ChatGPTga yuborgan rasmlarni boshqa saytlarda oʻz tashabbusi bilan qayta joylashtirganini tan olgan, bu 53 marta qayd etilgan. Ushbu AIlar bilan bogʻliq xavfsizlik hodisalarining haqiqiy soni eʼlon qilinganidan sezilarli darajada katta boʻlishi mumkin, chunki Amerika portali Axiosning kompaniyalarning ichki manbalariga tayanadigan maqolasi OpenAI va Anthropic oʻn minglab yaqinda sodir boʻlgan holatlarni tekshirayotganini koʻrsatadi.

OpenAI faqat qoʻshimcha himoya choralari mavjudligiga amin boʻlganda AI ishlab chiqishni tiklashini eʼlon qildi. Kompaniya algoritmlarini oʻqitishni toʻxtatishga ikkinchi marta qaror qildi; birinchi pauza iyul oyida Hugging Face hujumidan soʻng sodir boʻlgan edi.

Mashhur