AI[kutak]
Open Source

SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5

Novi model SenseNova U1.5-Lite-Preview nudi poboljšanu generaciju slika i tekstualnih sadržaja uz manje resurse, otvarajući put široj upotrebi AI tehnologije.

Uredio: Stevan K.20:29, 3. avgust 2026.1 min čitanja
SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5
Ilustracija je generisana veštačkom inteligencijom.

Više ne moramo da se oslanjamo samo na masivne AI modele kako bismo dobili visokokvalitetne rezultate. SenseTime je objavio otvoreni pregled svog novog multimodalnog modela SenseNova U1.5-Lite-Preview, koji kombinuje snagu i efikasnost uz znatno manje resursa.

Ovaj model, zasnovan na NEO-unify arhitekturi, nudi nativnu generaciju slika u 4K rezoluciji, preciznije tekstualne izlaze na engleskom i kineskom, kao i stabilnije mogućnosti za uređivanje slika. Sve to dostupno je uz samo 8B-MoT parametara, što čini model pristupačnijim za širu upotrebu.

Jedna od ključnih poboljšanja je bolje razumevanje dugih prirodnih jezičkih opisa i vizuelnih instrukcija. To omogućava precizniju kontrolu nad vizuelnim sadržajima, čak i kada su zahtevi kompleksni. U oblasti uređivanja slika, model podržava prenos stilova sa referentnih slika, kombinovano uređivanje sa više referentnih slika i interaktivno fino podešavanje. Ovo doprinosi pomaku od jednokratne generacije ka kontinuiranoj optimizaciji.

U poređenju sa prethodnom generacijom, SenseNova U1.5-Lite-Preview pokazuje bolje rezultate na više benchmark testova. SenseTime ističe da model uspeva da balansira između kvaliteta generacije i interaktivnih sposobnosti uz smanjenu veličinu modela, što dodatno snižava prag za primenu multimodalne AI tehnologije.

Model je već dostupan na GitHub-u, Hugging Face i ModelScope platformama, omogućavajući programerima i istraživačima da ga prilagode svojim potrebama. Istovremeno, SenseTime radi na SenseNova U1Pro, naprednijoj verziji namenjenoj profesionalnim kreatorima i korporativnim korisnicima, koja je trenutno u fazi testiranja uz pozivnice.

Ova priča govori o širem trendu u industriji: umesto samo povećavanja parametara, fokus se pomera na efikasnost, kontrolu i praktično iskustvo. SenseTime otvaranjem ovog modela pokazuje da visokoprofesionalne AI mogućnosti mogu postati dostupnije široj zajednici developera.

Podeli:TwitterLinkedInFacebook
Izvor →

Najnoviji članci

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda
Open Source

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda

Novi NVIDIA-ov okvir za agentičko RL smanjuje kompleksnost istraživanja, omogućavajući istraživačima da drže ceo kod u glavi. Kako to funkcioniše u praksi?

3. avgust 2026.

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima
Open Source

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima

Novi NVIDIA Transformer Engine omogućava značajno ubrzanje transformer modela kombinovanjem optimizovanih GPU kernela, BF16 računanja i FP8 izvršavanja.

3. avgust 2026.

AMD predstavlja Instella-MoE-16B-A3B: Otvoreni AI model sa 16 milijardi parametara
Open Source

AMD predstavlja Instella-MoE-16B-A3B: Otvoreni AI model sa 16 milijardi parametara

AMD je objavio potpuno otvoren Mixture-of-Experts (MoE) model sa impresivnim performansama, ali ograničenom komercijalnom upotrebom. Da li je ovo korak ka nezavisnim AI rešenjima?

2. avgust 2026.

Komentari (0)

Učitavanje komentara...