SenseTime Raccoon va API orqali 8K gacha aniqlikni qoʻllab-quvvatlovchi SenseNova U1 Pro tasvir yaratish modelini chiqardi
Batafsil
Pandaily
pandaily.com

SenseTime Raccoon va API orqali 8K gacha aniqlikni qoʻllab-quvvatlovchi SenseNova U1 Pro tasvir yaratish modelini chiqardi

SenseTime kompaniyasi oʻzining SenseNova U1 Pro tasvir yaratish modelining ishlab chiqarish versiyasini taqdim etdi. Bu model endi foydalanuvchilar uchun kompaniyaning Raccoon ilovasi orqali, shuningdek, SenseNova API xizmati orqali mavjud. TechNode tomonidan 2026-yil 22-sentabrda yetkazilgan maʼlumotlarga koʻra, bu maʼlumot Sina Finance da eʼlon qilingan bildirishnomadan olingan. Mahsulotning rasmiy inglizcha nomi — SenseTime / SenseNova.

Bu chiqarilish SenseNova U1.5 tadqiqoti va ochiq kodli oʻquv haqidagi oldingi yoritishdan farq qiladi. SenseTime U1 Pro matn-tasvir jarayonini navbatlash bilan ishlatadigan fikrlash zanjiridan foydalanib, tuzilgan maʼlumotlar va toʻgʻridan-toʻgʻri kanvas ustida oʻqiladigan matnni oʻz ichiga olgan vizual materiallar, shuningdek, ishlab chiqarishga mos maketlar yaratishini taʼkidlaydi.

Belgilar va pikselarni alohida bosqichlar sifatida koʻrish oʻrniga, model fikrlash bosqichlarini tasvir shakllanishi bilan integratsiya qiladi. Bu maket ierarxiyasi, tipografiya joylashuvi va grafik elementlar butun generatsiya jarayoni davomida bir xil boʻlishini taʼminlaydi. Mahsulot 8K gacha aniqlikdagi tasvirlarni chiqarishni qoʻllab-quvvatlaydi va foydalanuvchi tomonidan belgilangan nisbatlarni berish imkonini beradi, bu esa faqat ijtimoiy tarmoqlar uchun kvadrat kesimlar emas, balki katta formatlar va yuqori batafsiliq bilan ishlashga yoʻnaltirilgan.

Eʼlonida maqsadli vazifalar roʻyxati keltirilgan, jumladan infografika, plakatlar, arxitektura vizuallashtirishlar va butun tayyor mahsulotda bir xil uslub va tartib talab qiladigan boshqa kontent. Ushbu ssenariylar kompozitsiya va matnni tasvir ichida renderlash nazoratining zarurligini taʼkidlaydi, generatsiya tugagandan soʻng alohida tartiblash vositasidan foydalanish oʻrniga. Shu tariqa, marketing va dizayn jamoalari bitta soʻrov orqali ishlab chiqarishga tayyor kadrlarni soʻrashi mumkin.

Tarqatish ikki kanal orqali amalga oshiriladi: isteʼmolchilar va ijodkorlar Raccoon orqali kirishadi, mahsulot jamoalari esa generatsiyani oʻz ish jarayonlariga integratsiya qilish uchun SenseNova API orqali dasturiy kirishdan foydalana oladi. SenseTime TechNode ning ingliz tilidagi qisqacha mazmunida modelning toʻliq jamoatchilik kartochkasini parametrlar, litsenziyalash shartlari yoki mustaqil benchmark jadvallaridagi maʼlumotlar bilan chop etmagan. Shuning uchun xaridorlarga 8K chegarasi va tartiblash imkoniyatlari haqidagi bayonotlarni uchinchi tomon baholanishi paytgacha kompaniya bayonoti sifatida koʻrib chiqish tavsiya etiladi. Xitoy tasvir modellarini kuzatuvchi multimodal tizimlarning xaridorlari uchun eng yaqin signal Raccoon va API kanallarida ultra yuqori aniqlik cheklovi bilan tayyorlangan U1 Pro SKU mavjudligidir.

Oʻxshash hikoyalar

SenseTime SenseNova U1.5 ni chiqardi: oʻquv kodi ochiq boʻlgan birlashtirilgan koʻrish uchun 8 milliard parametrli model
Batafsil
pandaily.com

SenseTime SenseNova U1.5 ni chiqardi: oʻquv kodi ochiq boʻlgan birlashtirilgan koʻrish uchun 8 milliard parametrli model

SenseTime kompaniyasi sakkiz milliard parametrli SenseNova U1.5 modelini taqdim etdi, u piksel fazasida tushunish, fikrlash va yaratishni yagona tabiiy multimodal tizimda birlashtiradi.

Mavjud konveyerlardan farqli oʻlaroq, ular idrok qilish uchun koʻrish kodlovchisini va sintez qilish uchun alohida variatsion avtokodlovchini ishlatadi, U1.5 bu tashqi modullar boʻlmagan holda piksel va matnni umumiy ramkaga joylashtiradi. Bu kompaniyaning NEO-unify liniyasiga mos keladi, shu bilan birga ishlab chiqarish aniqliklarida yuqori aniqlikka erishish uchun fazoviy rekonstruksiya yaxshilandi.

Arxitektura oʻzgarishi mustaqil MLP patch dekodlashini yengil fazoviy dekoderni almashtirishdan iborat. Vizual tokenlar ikki oʻlchovli xususiyat maydoniga aylantiriladi, soʻngra Pixel Shuffle va mahalliy konvolutsiyalar bosqichlari yordamida tiklanadi, bu qoʻshni hududlarning piksel yakunlanishidan oldin maʼlumot almashishiga imkon beradi.

SenseTime shuni maʼlum qildiki, interfeys hali ham har bir 32x32 hududni bitta vizual token sifatida koʻrsatadi, ammo u oldingi U1 versiyasiga qaraganda kamroq tik toʻqnashuvlar va tekstura notekisliklari bilan 4K gacha tabiiy generatsiyani qoʻllab-quvvatlaydi. Bu kengroq nisbatlarda aniqlikni hisobga oladigan shovqinli konditsionlash tufayli amalga oshmadi.

Oʻqitishdan keyingi jarayon ixtisoslashish, soʻngra birlashtirish retseptiga amal qiladi. Kuchaytirilgan oʻqitish mutaxassislari vizual estetika, bilingual matn renderlash, infografika maketlash va tasvirni tahrirlashga eʼtibor qaratadi. Keyin siyosat boʻyicha koʻpmutaxassis destillatsiyasi bu koʻnikmalarni oʻzining generatsiya yoʻllari boʻylab bitta talabaga birlashtiradi.

SenseTime U1.5 natijalari U1 dan tasvir yaratish va tahrirlash maʼlumotlar toʻplamlari, shu jumladan raqobatbardosh bilingual matn renderlash va koʻpmanbalikli tahrirlashda ustunlikka ega ekanligini, shuningdek, standart STEM, VQA va OCR benchmarklarida multimodal tushunishning yuqori darajasini saqlab qolganini taʼkidlaydi.

arXiv va Hugging Face Papers da eʼlon qilingan texnik hisobot bilan birga, SenseTime nazoratli sozlash, kuchaytirilgan oʻqitish va siyosat boʻyicha destillatsiyani qamrab oluvchi oʻquv kodini ochiq eʼlon qilmoqda. Model aktivlari OpenSenseNova tashkiloti ostidagi SenseNova va Hugging Face kolleksiyalarida mavjud. Ushbu reliz U1.5-Lite-Preview ning dastlabki versiyasi emas, balki toʻliq U1.5 mahsulotidir va butunlay tadqiq etish, sozlash va qayta oʻqitishni istagan ishlab chiquvchilar uchun moʻljallangan kompakt tabiiy birlashtirilgan koʻrish modelidir.

Kinetix AI sunʼiy intellekt modellari uchun apparat taʼminotini rivojlantirish maqsadida 75 million dollarlik farishtalik moliyalashtirish turini jalb qildi
Batafsil
ventureburn.com

Kinetix AI sunʼiy intellekt modellari uchun apparat taʼminotini rivojlantirish maqsadida 75 million dollarlik farishtalik moliyalashtirish turini jalb qildi

Muhandislar uzoq vaqtdan beri muammo bilan duch kelishmoqdilar: bir soniyada roman yozishga qodir sunʼiy intellekt uni sindirmasdan moʻrt shishani ushlashda qiynaladi. Bu muammo raqamli intellekt va jismoniy ijro oʻrtasidagi sezilarli boʻshliq bilan bogʻliq.

Bu boʻshliqni bartaraf etish uchun dasturiy tizimlar va mexanik tana oʻrtasida mukammal va uzluksiz qayta aloqa zarur. Ushbu tor muammoni hal qilish uchun Kinetix AI katta va muhim farishtalik moliyalashtirish turida 75 million dollar jalb qildi, bu jismoniy intellekt sohasida jiddiy qadamdir.

Kompaniyaning tarixiy moliyalashtirish turiga Singapur Temasek Holdingsining kuchli ventura boʻlimi boʻlgan Vertex Ventures boshchilik qildi. Shuningdek, F&G Venture va Wanshi Capital ham ishtirok etib, Kinetix AI, yaʼni dastlabki bosqichdagi startapga 500 million yuan (taxminan 75 million dollar) investitsiya kiritishdi.

Kinetix AI kichik garaj loyihasi emas. 2025-yil sentabriboʻlib tashkil etilgan kompaniya tez orada 200 ga yaqin xodimga yetdi. Kinetix AI ning tez oʻsishining sababi avval Huawei avtonom qazuv yuk mashinalarini tijoratlashtirgan Bosh direktor Yu Tsze hisoblanadi.

Jamoaga HKU ning zoʻr oʻrinbosari Lo Pin va XPengdagi robototexnika boʻlimi rahbari Cheng Qunyuan ham kirishdi. Bu guruh akademik nazariya, avtonom transport vositalarining logikasi va ishlab chiqarish imkoniyatlari boʻyicha chuqur bilimga ega.

Koʻpgina robototexnika kompaniyalari sifatdan tejaydi, ammo Kinetix buni qabul qilmaydi. Kompaniya dunyo infratuzilmasi odamlar uchun yaratilganligi sababli, robotlar biz kabi koʻrinishi va harakatlashi kerakligiga qatʼiy ishongan. Bu ularning uzluksiz integratsiyasini taʼminlaydi.

Ularning flagman ijodi KAIBot 1,73 metr balandlikka va hayratlanarli darajada 115 ta erkinlik darajasiga ega. U yuqori sifat va ultrarealistiklik bilan ajralib turadi. Bunday robotni yaratish sezilarli darajada katta boshlangʻich xarajatlarni talab qilsa-da va taʼminot zanjiri haqiqiy dahshat boʻlsa-da, hammuallif Cheng Qunyuan arzon, sifatsiz uskuna bilan ishlashni oddiy ahmoqlik deb hisoblaydi. Haqiqiy inson shaklini mustahkamlash orqali ular oʻz AI modellarining istalgan boʻgʻin yangilanganida ishdan chiqmasligini kafolatlaydi.

Inson siluetini nafaqat taqlid qiladigan, balki inson harakati maʼlumotlariga mukammal mos keladigan robotni tasavvur qiling. Apparat taʼminoti toʻgʻridan-toʻgʻri biologiyamizni aks ettirganda, algoritmlik ish osonlikcha oʻtadi.

Asosiy sehr jalb qilingan kapital tufayli sodir boʻladi, bu ularning yopiq ekotizimini tezlashtirishga yoʻnaltirilgan. Buni uch boshli qushqoq sifatida tasavvur qilish mumkin. Birinchidan, multimodal, egotsentrik maʼlumotlar yigʻiladi. Keyin bu qayta ishlanmagan maʼlumotlar toʻgʻridan-toʻgʻri tanada mujassamlangan nativ fundamental modelga kiritiladi. Nihoyat, KAIBot va KAI Hand kabi apparat taʼminoti oʻrganilgan harakatlarni jismonan bajaradi.

Bu uzluksiz sikl «intellekt dvigateli»ni yaratadi. Robot real dunyodan sensor maʼlumotlarini yigʻib borishi natijasida AI modeli aqlliroq boʻlib boradi va jismoniy uskunalarning imkoniyatlarini darhol oshiradi. Endi har bir dasturiy taʼminot yangilanishida jismoniy mashinani qayta sozlash shart emas.

Tizimning dinamikligi 2026-yilda Odamlar uchun Jahon robototexnik oʻyinlarida namoyish etildi, u yerda ularning tizimi jahon chempioni Din Ningga qarshi stol tennisida oʻynadi. Maqsad murakkab real dunyo vazifalariga tayyor boʻlgan premium sinf robotlarini yaratishdir.

>

Mashhur