AI[kutak]
Veliki modeli

DeepSeek-V4-Flash: Revolucionarni AI model dostupan za široku upotrebu

Novi AI model DeepSeek-V4-Flash kombinuje visoke performanse i pristupačne cene, otvarajući vrata startup-ima i velikim kompanijama.

Uredio: Stevan K.15:38, 1. avgust 2026.1 min čitanja
DeepSeek-V4-Flash: Revolucionarni AI model dostupan za široku upotrebu
Ilustracija je generisana veštačkom inteligencijom.

DeepSeek-V4-Flash, najnoviji AI model od DeepSeek-a, donosi značajne performanse uz daleko niže troškove u odnosu na prethodne verzije. Sa cenom od samo $0.14 po milion input tokena i $0.28 po milion output tokena, ovaj model postaje izuzetno privlačan za startup-e i nezavisne developere. U poređenju sa V4-Pro modelom, koji košta $0.87 po milion output tokena, V4-Flash predstavlja trostruku uštedu.

Model je dostupan kroz API, što ga čini pristupačnim za širok spektar korisnika, ali i za samohostovanje, iako zahteva značajne hardverske resurse. Za potpuno precizno serviranje potreban je jedan 4×GB300 čvor, dok je za kvantizovanu verziju potrebno oko 110 GB RAM-a i VRAM-a. Ovo ga čini idealnim za srednje i velike kompanije sa postojećom infrastrukturom.

Arhitektura modela ostaje ista kao u aprilskoj verziji – MoE (Mixture of Experts) sa 284 milijarde parametara, od kojih je 13 milijardi aktivno po tokenu. Ključno poboljšanje dolazi od ponovnog treninga, a ne od nove arhitekture. Model koristi hibridnu pažnju, kombinujući Compressed Sparse Attention (CSA) i Heavily Compressed Attention (HCA), što doprinosi njegovoj efikasnosti.

DeepSeek je takode objavio benchmark rezultate, ali je važno napomenuti da su svi podaci dobijeni kroz interni testovi kompanije. DSBench-FullStack i DSBench-Hard pokazuju rezultate od 68.7 i 59.6 respektivno, ali nezavisni testovi mogu dati različite rezultate.

Sa MIT licencom i bez ograničenja u komercijalnoj upotrebi, DeepSeek-V4-Flash otvara nova vrata za implementaciju AI rešenja u raznim industrijama. Da li će ovaj model postati novi standard u svetu AI-a? Vreme će pokazati, ali jedna stvar je sigurna – DeepSeek je postavio visoku letvicu za konkurenciju.

Podeli:TwitterLinkedInFacebook
Izvor →

Najnoviji članci

SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5
Open Source

SenseTime otvara pristup svom laganom multimodalnom modelu SenseNova U1.5

Novi model SenseNova U1.5-Lite-Preview nudi poboljšanu generaciju slika i tekstualnih sadržaja uz manje resurse, otvarajući put široj upotrebi AI tehnologije.

3. avgust 2026.

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda
Open Source

NVIDIA predstavlja Molt: Kompaktni okvir za agentičko RL u samo 8.600 linija koda

Novi NVIDIA-ov okvir za agentičko RL smanjuje kompleksnost istraživanja, omogućavajući istraživačima da drže ceo kod u glavi. Kako to funkcioniše u praksi?

3. avgust 2026.

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima
Open Source

Kako NVIDIA Transformer Engine ubrzava rad transformer modela na GPU-ima

Novi NVIDIA Transformer Engine omogućava značajno ubrzanje transformer modela kombinovanjem optimizovanih GPU kernela, BF16 računanja i FP8 izvršavanja.

3. avgust 2026.

Komentari (0)

Učitavanje komentara...