deepseek

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash donosi 1M kontekst, nativnu viziju i inferenciju od 400 tok/s po cijeni od 0,15 USD po milijunu input tokena na asimetričnoj MoE...

Open WeightsMoEMultimodal VisionCode GenerationReasoning
deepseek logodeepseekDeepSeek V42026-09-10
Kontekst
1Mtokena
Maks. izlaz
384Ktokena
Ulazna cijena
$0.15/ 1M
Izlazna cijena
$0.60/ 1M
Modalitet:TextImage
Mogućnosti:VidAlatiStreamingZaključivanje
Benchmarks
GPQA
90.9%
GPQA: Znanstvena pitanja i odgovori na razini doktorata. Rigorozan benchmark s 448 pitanja višestrukog izbora iz biologije, fizike i kemije koje su kreirali stručnjaci. Doktori znanosti postižu samo 65-74% točnosti, dok nestručnjaci postižu samo 34% čak i s neograničenim pristupom internetu (otuda naziv 'otporan na Google'). DeepSeek V4.1 Flash je postigao 90.9% na ovom benchmarku.
HLE
36.8%
HLE: Rasuđivanje visoke razine stručnosti. Testira sposobnost modela da demonstrira rasuđivanje na razini stručnjaka u specijaliziranim domenama. Procjenjuje duboko razumijevanje složenih tema koje zahtijevaju znanje na profesionalnoj razini. DeepSeek V4.1 Flash je postigao 36.8% na ovom benchmarku.
MMLU
91%
MMLU: Masovno višezadaćno jezično razumijevanje. Sveobuhvatan benchmark s 16.000 pitanja višestrukog izbora iz 57 akademskih predmeta uključujući matematiku, filozofiju, pravo i medicinu. Testira široko znanje i sposobnosti rasuđivanja. DeepSeek V4.1 Flash je postigao 91% na ovom benchmarku.
MMLU Pro
81.2%
MMLU Pro: MMLU profesionalno izdanje. Poboljšana verzija MMLU-a s 12.032 pitanja koristeći teži format s 10 opcija. Pokriva matematiku, fiziku, kemiju, pravo, inženjerstvo, ekonomiju, zdravstvo, psihologiju, poslovanje, biologiju, filozofiju i informatiku. DeepSeek V4.1 Flash je postigao 81.2% na ovom benchmarku.
SimpleQA
49%
SimpleQA: Benchmark činjenične točnosti. Testira sposobnost modela da pruži točne, činjenične odgovore na jednostavna pitanja. Mjeri pouzdanost i smanjuje halucinacije u zadacima dohvaćanja znanja. DeepSeek V4.1 Flash je postigao 49% na ovom benchmarku.
IFEval
89.5%
IFEval: Evaluacija praćenja uputa. Mjeri koliko dobro model slijedi specifične upute i ograničenja. Testira sposobnost pridržavanja pravila formatiranja, ograničenja duljine i drugih eksplicitnih zahtjeva. DeepSeek V4.1 Flash je postigao 89.5% na ovom benchmarku.
AIME 2025
87.5%
AIME 2025: Američki pozivni matematički ispit. Matematički problemi natjecateljske razine s prestižnog AIME ispita dizajniranog za talentirane srednjoškolce. Testira naprednu matematičku sposobnost rješavanja problema koja zahtijeva apstraktno rasuđivanje, a ne samo prepoznavanje obrazaca. DeepSeek V4.1 Flash je postigao 87.5% na ovom benchmarku.
MATH
88.5%
MATH: Rješavanje matematičkih problema. Sveobuhvatan matematički benchmark koji testira rješavanje problema iz algebre, geometrije, računa i drugih matematičkih domena. Zahtijeva rasuđivanje u više koraka i formalno matematičko znanje. DeepSeek V4.1 Flash je postigao 88.5% na ovom benchmarku.
GSM8k
96.8%
GSM8k: Matematika osnovne škole 8K. 8.500 matematičkih zadataka osnovnoškolske razine koji zahtijevaju rasuđivanje u više koraka. Testira osnovnu aritmetiku i logičko razmišljanje kroz scenarije iz stvarnog života poput kupovine ili izračuna vremena. DeepSeek V4.1 Flash je postigao 96.8% na ovom benchmarku.
MGSM
92%
MGSM: Višejezična matematika osnovne škole. GSM8k benchmark preveden na 10 jezika uključujući španjolski, francuski, njemački, ruski, kineski i japanski. Testira matematičko rasuđivanje na različitim jezicima. DeepSeek V4.1 Flash je postigao 92% na ovom benchmarku.
MathVista
72.5%
MathVista: Matematičko vizualno rasuđivanje. Testira sposobnost rješavanja matematičkih problema koji uključuju vizualne elemente poput grafikona, geometrijskih dijagrama i znanstvenih figura. Kombinira vizualno razumijevanje s matematičkim rasuđivanjem. DeepSeek V4.1 Flash je postigao 72.5% na ovom benchmarku.
SWE-Bench
74.2%
SWE-Bench: Benchmark softverskog inženjerstva. AI modeli pokušavaju riješiti stvarne GitHub probleme u Python projektima otvorenog koda s ljudskom verifikacijom. Testira praktične vještine softverskog inženjerstva na produkcijskim kodnim bazama. Najbolji modeli su napredovali s 4,4% u 2023. na preko 70% u 2024. DeepSeek V4.1 Flash je postigao 74.2% na ovom benchmarku.
HumanEval
92.5%
HumanEval: Python programerski problemi. 164 ručno napisana programerska problema gdje modeli moraju generirati ispravne implementacije Python funkcija. Svako rješenje se verificira jediničnim testovima. Najbolji modeli sada postižu preko 90% točnosti. DeepSeek V4.1 Flash je postigao 92.5% na ovom benchmarku.
LiveCodeBench
73.3%
LiveCodeBench: Benchmark živog kodiranja. Testira sposobnosti kodiranja na kontinuirano ažuriranim izazovima programiranja iz stvarnog svijeta. Za razliku od statičnih benchmarka, koristi svježe probleme za sprečavanje kontaminacije podataka i mjerenje pravih vještina kodiranja. DeepSeek V4.1 Flash je postigao 73.3% na ovom benchmarku.
MMMU
78.9%
MMMU: Multimodalno razumijevanje. Masivni višedisciplinarni multimodalni benchmark razumijevanja koji testira modele vida i jezika na problemima sveučilišne razine iz 30 predmeta koji zahtijevaju razumijevanje slika i stručno znanje. DeepSeek V4.1 Flash je postigao 78.9% na ovom benchmarku.
MMMU Pro
58.4%
MMMU Pro: MMMU profesionalno izdanje. Poboljšana verzija MMMU-a s težim pitanjima i strožom evaluacijom. Testira napredno multimodalno rasuđivanje na profesionalnoj i stručnoj razini. DeepSeek V4.1 Flash je postigao 58.4% na ovom benchmarku.
ChartQA
88%
ChartQA: Pitanja i odgovori o grafikonima. Testira sposobnost razumijevanja i rasuđivanja o informacijama prikazanim u grafikonima i dijagramima. Zahtijeva ekstrakciju podataka, usporedbu vrijednosti i izvođenje izračuna iz vizualnih prikaza podataka. DeepSeek V4.1 Flash je postigao 88% na ovom benchmarku.
DocVQA
93%
DocVQA: Vizualna Q&A o dokumentima. Benchmark vizualnih pitanja i odgovora o dokumentima koji testira sposobnost ekstrakcije i rasuđivanja o informacijama iz slika dokumenata uključujući obrasce, izvješća i skenirani tekst. DeepSeek V4.1 Flash je postigao 93% na ovom benchmarku.
Terminal-Bench
90.6%
Terminal-Bench: Terminal/CLI zadaci. Testira sposobnost izvođenja operacija naredbenog retka, pisanja shell skripti i navigacije u terminalskim okruženjima. Mjeri praktične vještine administracije sustava i razvojnih radnih tokova. DeepSeek V4.1 Flash je postigao 90.6% na ovom benchmarku.
ARC-AGI
11.4%
ARC-AGI: Apstrakcija i rasuđivanje. Korpus apstrakcije i rasuđivanja za AGI - testira fluidnu inteligenciju kroz nove zagonetke prepoznavanja obrazaca. Svaki zadatak zahtijeva otkrivanje temeljnog pravila iz primjera, mjereći opću sposobnost rasuđivanja umjesto memoriranja. DeepSeek V4.1 Flash je postigao 11.4% na ovom benchmarku.

O modelu DeepSeek V4.1 Flash

Saznajte o mogućnostima, značajkama i načinima korištenja modela DeepSeek V4.1 Flash.

DeepSeek V4.1 Flash je mixture-of-experts model otvorenih težina koji sadrži ukupno 552 milijarde parametara. Model uvodi asimetričnu strukturu kodera i dekodera s uzročnom vezom (causal encoder-decoder) dizajniranu za minimiziranje troškova inferencije tijekom radnih opterećenja visoke propusnosti. Tijekom obrade dolaznih promptova, mreža aktivira samo 8 milijardi parametara, što se povećava na 16 milijardi tijekom generiranja tokena. Temeljna osnova uključuje komprimirano keširanje ključ-vrijednost (KV caching) dijeljeno među slojevima, dvostupanjski rijetki indeksator (sparse indexer) i Engram memoriju za pretraživanje od 196 milijardi parametara, a sve je trenirano na korpusu od 45 bilijuna tokena.

Za razliku od ranijih iteracija u V4 obitelji, nativno vizualno razumijevanje dolazi standardno bez zasebne vizualne kontrolne točke. Model prihvaća slike izravno unutar standardnih tekstualnih promptova i procjenjuje vizualne artefakte kao što su arhitektonski grafikoni, rasporedi korisničkog sučelja i tehnički dijagrami. Istovremeno, način rada s razmišljanjem (thinking mode) funkcionira nativno, generirajući eksplicitne tragove reasoninga prije stvaranja konačnih odgovora. Model radi pri brzinama generiranja između 300 i 427 tokena u sekundi na modernim klasterima ubrzivača, podudarajući se ili premašujući profil latencije mnogo manjih gustih modela uz zadržavanje sposobnosti reasoninga na razini doktora znanosti (PhD).

DeepSeek je pozicionirao V4.1 Flash kao izravnu zamjenu za veći flagship model V4 Pro. U evaluacijama treće strane koje obuhvaćaju generiranje frontenda, rad s terminalom i ispravljanje softverskih pogrešaka, V4.1 Flash je ispunio ili premašio točnost V4 Pro modela uz nižu latenciju i manju računalnu potrošnju. Model služi za okruženja s velikim volumenom agenata, automatizirane alate terminala i kontinuirane radne procese sinteze koda gdje su cijene flagship API-ja obično previsoke.

DeepSeek V4.1 Flash

Slučajevi korištenja za DeepSeek V4.1 Flash

Otkrijte različite načine korištenja modela DeepSeek V4.1 Flash za postizanje izvrsnih rezultata.

Autonomne terminalske i shell operacije

Izvršava sistemsku dijagnostiku, pokreće alate za izgradnju (build tools) i rješava pogreške okruženja unutar kontejneriziranih sustava, ostvarujući rezultat 90,6 na Terminal-Bench 2.1 benchmarku.

Full-Stack UI i frontend izrada prototipova

Generira interaktivne aplikacije na jednoj stranici (SPA), WebGL shadere, Three.js 3D okruženja i responzivne rasporede nadzornih ploča iz tekstualnih ili vizualnih promptova u jednom potezu.

Složeno ispravljanje pogrešaka u kodu s više datoteka

Skenira cijele softverske projekte s više repozitorija unutar svog context windowa od 1 milijun tokena, prati uvoze između datoteka te ispravlja obnutu logiku ili race condition probleme.

Automatizirano vizualno izvlačenje dokumenata

Pregledava složene arhitektonske nacrte, dijagrame protoka podataka i makete korisničkog sučelja kako bi generirao strukturirane JSON sheme i primjenjive API ugovore.

Agentic pozivanje alata visoke propusnosti

Pokreće kontinuirane pozadinske petlje reasoninga koje ispituju live REST krajnje točke, upituju SQL baze podataka i provjeravaju nepromjenjive promjene stanja kroz više krugova izvršavanja.

Višejezično prevođenje i analiza dijalekata

Prevodi idiome, regionalni slang i tehničku dokumentaciju u dijalektima s manje resursa, istovremeno označavajući nesigurne prijevode umjesto da halucinira termine.

Prednosti

Ograničenja

Asimetrična MoE učinkovitost: Aktivira samo 8B parametara na inputu i 16B na outputu od ukupno 552B, čime cijena inputa izvan vršnog opterećenja ostaje na 0,15 USD po milijunu tokena.
Pretjerano razmišljanje o logici: Troši prekomjerne tokene za reasoning na jednostavnim promptovima za kodiranje ako korisnik ne ograniči trud razmišljanja.
Vrhunske performanse agenata: Dostiže 90,6% na Terminal-Bench 2.1 i 74,2% na DeepSWE v1.1, čime izjednačava ili nadmašuje flagship vlasnička rješenja na inženjerskim zadacima.
Netočnost kinematike i fizike: Povremeno proizvodi anomalije u putanjama kretanja i upitnu fiziku pri generiranju složenih 3D kinematskih animacija u Three.js testovima.
Generiranje visoke propusnosti: Isporučuje provjerene brzine dekodiranja između 300 i 427 tokena u sekundi, drastično skraćujući vrijeme obrade za agente koji ovise o reasoning-u.
Estetska ograničenja korisničkog sučelja: Zaostaje za vlasničkim flagship modelima u sofisticiranoj tipografiji i razmaku, proizvodeći funkcionalne, ali vizualno generičke hijerarhije nadzornih ploča.
Unificirani multimodalni kontekst: Nativno unosi vizualne i tekstualne tokene unutar context windowa od 1.000.000 tokena bez dodatnog opterećenja sekundarnih vizualnih adaptera.
Zahtjevna lokalna memorija: Zahtijeva specijalizirane postave s više GPU-ova kako bi se udovoljilo golemom memorijskom otisku od 552B parametara za lokalno hostanje u punoj preciznosti.

API brzi početak

deepseek/deepseek-v4.1-flash

Pogledaj dokumentaciju
deepseek SDK
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.deepseek.com",
  apiKey: process.env.DEEPSEEK_API_KEY,
});

async function main() {
  const completion = await client.chat.completions.create({
    model: "deepseek-flash",
    messages: [
      { role: "system", content: "You are an expert systems engineer." },
      { role: "user", content: "Write a high-performance WebGL compute shader." },
    ],
  });

  console.log(completion.choices[0].message.content);
}

main();

Instalirajte SDK i počnite s API pozivima za nekoliko minuta.

Što ljudi kažu o modelu DeepSeek V4.1 Flash

Pogledajte što zajednica misli o modelu DeepSeek V4.1 Flash

Dosegao je 98% rezultata modela GPT-6 Astra uz 1,4% cijene na svakodnevnim dizajnerskim zadacima na temelju korisničkih zahtjeva. Svaki model osim Astre postigao je lošiji rezultat I koštao više.
OpenDesign (@OpenDesignHQ)
twitter
Deepseek V4.1 Flash 552B ukupno, 8/16B aktivnih s novom arhitekturom treniranom na 45T tokena... ovo je vjerojatno najinovativnija arhitektura koju sam vidio u dugo vremena, prilično ludo.
Elie Bakouch (@eliebakouch)
twitter
Brzina je puno važnija nego što ljudi misle, iskreno, radije bih uzeo malo lošiji model koji je 2x brži za većinu slučajeva korištenja u proizvodima.
MoneyLovesSpeed
hackernews
U jednom trenutku dosegao je nevjerojatnih 427 tokena u sekundi. No, najluđe od svega je što je cijelo izvođenje navodno koštalo samo 30 centi.
WorldofAI
youtube
Činjenica da se upiti za V4 Pro automatski preusmjeravaju na V4.1 Flash govori vam sve o tome koliko je ova arhitektura zapravo dobra.
KevDev99
reddit
Terminal-Bench na 90,6 je sjajan rezultat za model u ovom cjenovnom razredu. Agentic alati upravo su postali radikalno jeftiniji.
SysAdminHero
reddit

Videozapisi o modelu DeepSeek V4.1 Flash

Gledajte tutorijale, recenzije i diskusije o modelu DeepSeek V4.1 Flash

Ovaj novi DeepSeek verzija 4.1 flash model je nevjerojatno brz. Dobivate oko 400 tokena u sekundi, a brzina je iskreno luda.

Za reasoning model s ovakvom razinom sposobnosti, ta vrsta brzine je ozbiljno impresivna, posebno s obzirom na to da je ovo samo privremena testna verzija.

U jednom trenutku dosegao je nevjerojatnih 427 tokena u sekundi. No, najluđe od svega je što je cijelo izvođenje navodno koštalo samo 30 centi.

Testovi u stvarnom svijetu bilježe 300 do 400 plus tokena u sekundi, dosežući 98% rezultata dizajnerskog benchmarka modela GPT6 Astra.

Ne generira kod, već zapravo provjerava vlastitu matematiku. Čak je samostalno uočio suptilan bug vezan uz kontrolu orbite.

težine i jednom kada izađu u finalnoj verziji, provjerit ćemo ih. Opet, ako želite podržati kanal, postanite član. Hvala

Pokretanje cijelog testnog paketa Artificial Analysis s ovim modelom košta 72 USD. To je 10 puta jeftinije od modela s istim ocjenama inteligencije.

DeepSeek V4 Flash je zapravo najjeftiniji od svih modela, a GPT 5.6 Luna koji košta isto zapravo je dva boda iza na Indeksu inteligencije.

Svakako uživam u ovom trendu kineskih laboratorija koji dolaze i podcjenjuju američke laboratorije cijenom, a istovremeno pariraju njihovoj inteligenciji.

Vise od samo promptova

Poboljšajte svoj radni tijek sa AI Automatizacijom

Automatio kombinira moc AI agenata, web automatizacije i pametnih integracija kako bi vam pomogao postici vise za manje vremena.

AI Agenti
Web Automatizacija
Pametni Tokovi

Pro Savjeti za DeepSeek V4.1 Flash

Stručni savjeti za maksimalno iskorištavanje DeepSeek V4.1 Flash.

Upravljanje razinom reasoninga

Postavite razinu reasoninga na low za jednostavnu generaciju CRUD operacija, a na high ili max prilikom rješavanja višekrakih matematičkih problema ili složenih bugova u kodnoj bazi kako biste optimizirali potrošnju tokena.

Maksimalno iskorištavanje predmemoriranja promptova

Grupirajte uzastopne system promptove i reference na statične datoteke na početku context windowa kako biste povećali pogodke predmemorije promptova po cijeni izvan vršnog opterećenja od 0,003 USD/M.

Izravan multimodalni input

Priložite sirove slike i vizualne makete (mockups) izravno uz CSS zahtjeve umjesto ručnog prepisivanja specifikacija izgleda radi bolje prostorne točnosti.

Korištenje službenih naziva modela

Koristite službeni naziv modela deepseek-flash u API zahtjevima kako biste osigurali automatsko usmjeravanje na najnoviju aktivnu kontrolnu točku i najučinkovitiju cijenu.

Svjedočanstva

Sto Kazu Nasi Korisnici

Pridruzite se tisucama zadovoljnih korisnika koji su transformirali svoj radni tijek

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Povezani AI Models

moonshot

Kimi k2.6

Moonshot

Kimi k2.6 is Moonshot AI's 1T-parameter MoE model featuring a 256K context window, native video input, and elite performance in autonomous agentic coding.

256K context
$0.95/$4.00/1M
anthropic

Claude Opus 4.6

Anthropic

Claude Opus 4.6 is Anthropic's flagship model featuring a 1M token context window, Adaptive Thinking, and world-class coding and reasoning performance.

1M context
$5.00/$25.00/1M
google

Gemini 3 Flash

Google

Gemini 3 Flash is Google's high-speed multimodal model featuring a 1M token context window, elite 90.4% GPQA reasoning, and autonomous browser automation tools.

1M context
$0.50/$3.00/1M
deepseek

DeepSeek v4

DeepSeek

DeepSeek v4 is a 1.6T parameter MoE model featuring a 1M token context window and native multimodal support for text, vision, and video at disruptive prices.

1M context
$1.74/$3.48/1M
anthropic

Claude Sonnet 4.6

Anthropic

Claude Sonnet 4.6 offers frontier performance for coding and computer use with a massive 1M token context window for only $3/1M tokens.

1M context
$3.00/$15.00/1M
google

Gemini 3 Pro

Google

Google's Gemini 3 Pro is a multimodal powerhouse featuring a 1M token context window, native video processing, and industry-leading reasoning performance.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M

Često Postavljana Pitanja o DeepSeek V4.1 Flash

Pronađite odgovore na česta pitanja o DeepSeek V4.1 Flash