Grok 4.5 i GPT-Live: Nova generacija AI modela za razgovore i kodiranje
OpenAI predstavlja revolucionarni glasovni model GPT-Live koji može istovremeno da sluša i govori, dok Grok 4.5 postaje najjači alat za programere. Šta još donosi najnovija generacija AI alata?
Zamislite AI asistenta koji ne mora da čeka da završite rečenicu da bi odgovorio - već može da razgovara potpuno prirodno, poput ljudskog sagovornika. OpenAI je upravo to omogućio sa GPT-Live, prvim full-duplex glasovnim modelom koji može istovremeno da sluša i govori, čuvajući fluidnost dijaloga. Štaviše, model može da delegira kompleksnije zadatke GPT-5.5 bez prekida u komunikaciji.
U paraleli, SpaceXAI je lansirao Grok 4.5, svoj najmoćniji model za kodiranje i "agentic tasks". Ova verzija je trenirana zajedno sa Cursor platformom, što joj daje prednost u rešavanju kompleksnih programerskih izazova. Za sada nema detalja o tome koliko je model napredniji od prethodne verzije, ali tvrdnje kompanije sugerišu značajan skok u performansama.
Meta takođe ulazi u igru sa Muse Image, modelom za generisanje i editovanje slika koji sada radi u Instagram Stories i WhatsAppu. Zanimljivo je da model može koristiti javne Instagram fotografije kao referencu kada korisnik taguje nalog, ali generisane slike nose nevidljivi vodeni žig.
Sa druge strane, ByteDance predstavlja Seedream 5.0 Pro - multimodalni model za kreiranje slika sa naprednim funkcionalnostima za dizajnere i marketinške timove. Podržava preko 10 jezika, uključujući i one sa pisanjem s desna na levo, što ga čini posebno atraktivnim za globalne timove.
U sferi bezbednosti AI sistema, Anthropic je razvio GRAM (Gradient-Routed Auxiliary Modules) - sistem koji omogućava brisanje specifičnih delova znanja modela nakon treninga. Ovo rešenje može biti ključno za kontrolu "dual-use" tehnologija koje mogu imati i vojnu primenu.
Dok se veliki igrači takmiče u poboljšanju svojih modela, OpenAI je otkrio da čak 30% zadataka u SWE-Bench Pro evaluaciji ima greške, što dovodi u pitanje pouzdanost standardnih testova za merenje programerskih sposobnosti AI sistema. Ovo otkriće može promeniti način na koji se vrši benchmarking budućih modela.
Kako AI postaje sve sofisticiraniji, pitanje je da li će standardi evaluacije moći da drže korak sa njegovim napretkom - ili će morati da se reinventiraju kako bi ostali relevantni.