DeepSeek je 10. septembra 2026 objavil model DeepSeek-V4.1-Flash, najmanjši model v svoji novi družini arhitektur z lastno vizualno (multimodalno) podporo. Model je razvilo podjetje DeepSeek in ga takoj objavilo na svoji spletni strani.
Asimetrična arhitektura z manj aktivnimi parametri
Model uporablja asimetrično MoE arhitekturo s 552 milijardami parametrov, od katerih je aktivnih le 8 milijard za vhod in 16 milijard za izhod. Gre za novo causal encoder–decoder zasnovo, ki jo je podjetje opisalo takole:
»New Causal Encoder–Decoder architecture: just 8B active parameters for input, 16B for output.«
Povzetek: nova zasnova loči obdelavo vhoda od izhoda in za vsak del uporabi drugačno število aktivnih parametrov, namesto da bi za oboje aktivirala enako količino uteži kot pri simetričnih MoE modelih. Po navedbah DeepSeeka nova zasnova hkrati zmanjša tudi potrebe po pomnilniku — KV-predpomnilnik naj bi potreboval le četrtino HBM prostora in osmino SSD prostora prejšnje generacije. Manjši predpomnilnik je pomemben predvsem pri daljših pogovorih in agentskih opravilih, kjer model ves čas hrani zgodovino konteksta.
Dostopnost, cene in preusmeritev z V4-Pro
Model je takoj na voljo prek DeepSeek API pod imenom deepseek-flash, objavljen pa je tudi na Hugging Face pod licenco MIT, ki dovoljuje tudi komercialno uporabo brez dodatnega dovoljenja. Nove, nižje cene klicev veljajo od 4. ure UTC 10. septembra 2026.
DeepSeek je sporočil tudi, da bo od 4. ure UTC 14. septembra 2026 vse zahteve za dosedanji dražji model V4-Pro postopoma preusmeril na V4.1-Flash, in sicer po cenah novega modela. To v praksi pomeni, da bodo obstoječi uporabniki V4-Pro samodejno prešli na cenejši model, ne da bi morali sami spreminjati kodo ali klice API. Podjetje ob tem navaja, da naj bi testi tretjih strani model uvrstili pred V4-Pro po zmogljivosti, ceni in hitrosti — gre za lastno trditev DeepSeeka, ki v tem zagonu ni bila neodvisno preverjena.
Kaj to pomeni za slovenska podjetja
Za manjše ekipe in startupe odprtokoden model pod licenco MIT z nižjimi cenami klicev pomeni, da lahko zmogljiv jezikovni model poganjajo po nižji ceni, ne da bi se morale pogajati s ponudnikom o pogojih uporabe. Ker je model objavljen pod odprto licenco, ga je mogoče tudi prenesti in gostiti na lastni infrastrukturi, kar je zanimivo za podjetja, ki želijo obdržati nadzor nad podatki. Ker gre pri primerjavi z V4-Pro za lastno oceno podjetja, je pred odločitvijo o prehodu smiselno počakati na neodvisne primerjave zmogljivosti.
Vir: DeepSeek, »Introducing DeepSeek-V4.1-Flash: smarter, faster, more efficient.«
Viri in nadaljnje branje:
