AI[kutak]
Veliki modeli

Nemotron 3 Ultra: Otvoreni AI model koji nadmašuje zatvorene rešenja

NVIDIA Nemotron 3 Ultra postiže bolje rezultate od vodećih zatvorenih modela uz 10 puta niže troškove, zahvaljujući optimizaciji LangChain platforme.

Uredio: Stevan K.20:04, 8. jul 2026.1 min čitanja
Nemotron 3 Ultra: Otvoreni AI model koji nadmašuje zatvorene rešenja
Ilustracija je generisana veštačkom inteligencijom.

NVIDIA je objavila da njihov otvoreni AI model Nemotron 3 Ultra sada nudi vodeće performanse po nižoj ceni u poređenju sa vrhunskim zatvorenim modelima. Ključni partner u ovom uspehu je LangChain, čija je platforma za upravljanje AI agentima prilagođena specifično za Nemotron 3 Ultra.

Prema LangChain-ovom Deep Agents benchmarku, Nemotron 3 Ultra ne samo da dostigne preciznost najboljih zatvorenih modela, već obavlja više zadataka uz veći protok i sa 10 puta nižim troškovima inferencije po pokretanju. Sve ove prednosti postignute su bez ikakvog ponovnog treniranja modela – isključivo kroz inženjering okruženja oko modela.

"Način da napravimo bolje agente je da stalno poboljšavamo sistem oko modela", izjavio je Harrison Chase, koosnivač i CEO LangChain-a. "Memorija, upotreba alata, evaluacija i ponašanje modela se multiplikuju kada timovi mogu da ih podešavaju zajedno." Ova saradnja pokazuje da preduzeća mogu dobiti vrhunske performanse od otvorenog steka zadržavajući kontrolu nad sistemima koje grade.

Kompanije kao što su Abridge, Amdocs i Box već ugradjuju specijalizovane agente direktno u svoje platforme, dok globalni integrator EY širi svoje NVIDIA implementacione kapacitete koristeći NemoClaw nacrte za LangChain Deep Agents. Ovo omogućava klijentima da prilagode, evaluiraju i upravljaju specijalizovanim agentima kroz visoko vredne workflow-ove.

Ključna prednost ovog pristupa je u tome što se fokusira na "harness engineering" umesto na fino podešavanje modela. LangChain-ov tim je analizirao izvršne tragove deep agenta kako bi identifikovao tačno gde gubi poene, a zatim optimizirao sistemske promptove, opise alata i middleware oko modela. Svi developeri koji koriste LangChain Deep Agents sa Nemotron 3 Ultra mogu odmah iskoristiti ove optimizacije – prilagođeni profil je dostupan direktno kroz LangChain.

NVIDIA NemoClaw za LangChain Deep Agents predstavlja otvoreni referentni nacrt koji pakuje ovaj rad za preduzeća koja grade sopstvene specijalizovane AI sisteme – modele, alate i runtime – prilagođene njihovim workflow-ovima. Kombinacija otvorenog modela, otvorenog harnessa i otvorenog sigurnog runtime-a znači da preduzeća poseduju kompletan stek od početka do kraja, sa mogućnošću prilagođavanja, kontinuiranog poboljšavanja i pokretanja bilo gde – na sopstvenoj infrastrukturi, u sopstvenom oblaku, pod sopstvenim pravilima upravljanja.

Za developere koji žele da počnu, Nemotron 3 Ultra je dostupan na platformama Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius i Together AI. EY pak nema pomoć preduzećima u izgradnji specijalizovanih agenata koristeći ovaj otvoreni softverski stek. Kako agenti preuzimaju sve važnije poslove u biznisu, mogućnost potpunog posedovanja i prilagođavanja AI steka postaje ključna prednost za preduzeća koja žele da se izdvoje.

Podeli:TwitterLinkedInFacebook
Izvor →

Najnoviji članci

SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5
Open Source

SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5

Novi model SenseNova U1.5-Lite-Preview nudi poboljšanu generaciju slika i tekstualnih sadržaja uz manje resurse, otvarajući put široj upotrebi AI tehnologije.

3. avgust 2026.

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda
Open Source

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda

Novi NVIDIA-ov okvir za agentičko RL smanjuje kompleksnost istraživanja, omogućavajući istraživačima da drže ceo kod u glavi. Kako to funkcioniše u praksi?

3. avgust 2026.

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima
Open Source

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima

Novi NVIDIA Transformer Engine omogućava značajno ubrzanje transformer modela kombinovanjem optimizovanih GPU kernela, BF16 računanja i FP8 izvršavanja.

3. avgust 2026.

Komentari (0)

Učitavanje komentara...