deepseek

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash leverer 1M context, native vision og 400 tok/s inference til $0,15 pr. million input tokens på en asymmetrisk MoE-arkitektur.

Open WeightsMoEMultimodal VisionCode GenerationReasoning
deepseek logodeepseekDeepSeek V42026-09-10
Kontekst
1Mtokens
Maks output
384Ktokens
Input-pris
$0.15/ 1M
Output-pris
$0.60/ 1M
Modalitet:TextImage
Funktioner:VisionVærktøjerStreamingRæsonnering
Benchmarks
GPQA
90.9%
GPQA: Spørgsmål og svar på kandidatniveau. En streng benchmark med 448 multiple choice-spørgsmål inden for biologi, fysik og kemi skabt af domæneeksperter. PhD-eksperter opnår kun 65-74% nøjagtighed, mens ikke-eksperter scorer kun 34% selv med ubegrænset webadgang (derfor 'Google-proof'). DeepSeek V4.1 Flash scorede 90.9% på denne benchmark.
HLE
36.8%
HLE: Ekspertniveau-ræsonnering. Tester en models evne til at demonstrere ekspertniveau-ræsonnering på tværs af specialiserede domæner. Evaluerer dyb forståelse af komplekse emner, der kræver professionel viden. DeepSeek V4.1 Flash scorede 36.8% på denne benchmark.
MMLU
91%
MMLU: Massiv flerfaglig sprogforståelse. En omfattende benchmark med 16.000 multiple choice-spørgsmål på tværs af 57 akademiske fag, herunder matematik, filosofi, jura og medicin. Tester bred viden og ræsonneringsevner. DeepSeek V4.1 Flash scorede 91% på denne benchmark.
MMLU Pro
81.2%
MMLU Pro: MMLU Professionel udgave. En forbedret version af MMLU med 12.032 spørgsmål i et sværere format med 10 svarmuligheder. Dækker matematik, fysik, kemi, jura, ingeniørvidenskab, økonomi, sundhed, psykologi, business, biologi, filosofi og datalogi. DeepSeek V4.1 Flash scorede 81.2% på denne benchmark.
SimpleQA
49%
SimpleQA: Faktuel nøjagtighedsbenchmark. Tester en models evne til at give nøjagtige, faktuelle svar på ligetil spørgsmål. Måler pålidelighed og reducerer hallucinationer i vidensindhentningstasks. DeepSeek V4.1 Flash scorede 49% på denne benchmark.
IFEval
89.5%
IFEval: Instruktionsfølgningsevaluering. Måler, hvor godt en model følger specifikke instruktioner og begrænsninger. Tester evnen til at overholde formateringsregler, længdegrænser og andre eksplicitte krav. DeepSeek V4.1 Flash scorede 89.5% på denne benchmark.
AIME 2025
87.5%
AIME 2025: American Invitational Math Exam. Konkurrence-niveau matematikopgaver fra den prestigefyldte AIME-eksamen designet til talentfulde gymnasieelever. Tester avanceret matematisk problemløsning, der kræver abstrakt tænkning, ikke kun mønstergenkendelse. DeepSeek V4.1 Flash scorede 87.5% på denne benchmark.
MATH
88.5%
MATH: Matematisk problemløsning. En omfattende matematikbenchmark, der tester problemløsning inden for algebra, geometri, calculus og andre matematiske domæner. Kræver flertrinssværsonnering og formel matematisk viden. DeepSeek V4.1 Flash scorede 88.5% på denne benchmark.
GSM8k
96.8%
GSM8k: Folkeskole matematik 8K. 8.500 folkeskole-niveau matematiske tekstopgaver, der kræver flertrinssræsonnering. Tester grundlæggende aritmetik og logisk tænkning gennem virkelige scenarier som shopping eller tidsberegninger. DeepSeek V4.1 Flash scorede 96.8% på denne benchmark.
MGSM
92%
MGSM: Flersproget folkeskolematematik. GSM8k-benchmarken oversat til 10 sprog, herunder spansk, fransk, tysk, russisk, kinesisk og japansk. Tester matematisk ræsonnering på tværs af forskellige sprog. DeepSeek V4.1 Flash scorede 92% på denne benchmark.
MathVista
72.5%
MathVista: Matematisk visuel ræsonnering. Tester evnen til at løse matematikopgaver, der involverer visuelle elementer som diagrammer, grafer, geometriske figurer og videnskabelige illustrationer. Kombinerer visuel forståelse med matematisk ræsonnering. DeepSeek V4.1 Flash scorede 72.5% på denne benchmark.
SWE-Bench
74.2%
SWE-Bench: Softwareingeniør-benchmark. AI-modeller forsøger at løse rigtige GitHub-issues i open source Python-projekter med menneskelig verifikation. Tester praktiske softwareingeniørfærdigheder på produktionskodebaser. Topmodeller gik fra 4,4% i 2023 til over 70% i 2024. DeepSeek V4.1 Flash scorede 74.2% på denne benchmark.
HumanEval
92.5%
HumanEval: Python-programmeringsopgaver. 164 håndskrevne programmeringsopgaver, hvor modeller skal generere korrekte Python-funktionsimplementeringer. Hver løsning verificeres mod unit tests. Topmodeller opnår nu 90%+ nøjagtighed. DeepSeek V4.1 Flash scorede 92.5% på denne benchmark.
LiveCodeBench
73.3%
LiveCodeBench: Live kodningsbenchmark. Tester kodningsevner på løbende opdaterede, virkelige programmeringsudfordringer. I modsætning til statiske benchmarks bruger den friske problemer for at forhindre dataforurening og måle ægte kodningsevner. DeepSeek V4.1 Flash scorede 73.3% på denne benchmark.
MMMU
78.9%
MMMU: Multimodal forståelse. Massiv multi-disciplin multimodal forståelsesbenchmark, der tester vision-sprogmodeller på universitetsniveau-problemer på tværs af 30 fag, der kræver både billedforståelse og ekspertviden. DeepSeek V4.1 Flash scorede 78.9% på denne benchmark.
MMMU Pro
58.4%
MMMU Pro: MMMU Professionel udgave. Forbedret version af MMMU med mere udfordrende spørgsmål og strengere evaluering. Tester avanceret multimodal ræsonnering på professionelt og ekspertniveau. DeepSeek V4.1 Flash scorede 58.4% på denne benchmark.
ChartQA
88%
ChartQA: Diagram-spørgsmål og svar. Tester evnen til at forstå og ræsonnere om information præsenteret i diagrammer og grafer. Kræver udtrækning af data, sammenligning af værdier og udførelse af beregninger fra visuelle datarepræsentationer. DeepSeek V4.1 Flash scorede 88% på denne benchmark.
DocVQA
93%
DocVQA: Dokument visuel Q&A. Document Visual Question Answering benchmark, der tester evnen til at udtrække og ræsonnere om information fra dokumentbilleder, herunder formularer, rapporter og scannet tekst. DeepSeek V4.1 Flash scorede 93% på denne benchmark.
Terminal-Bench
90.6%
Terminal-Bench: Terminal/CLI-opgaver. Tester evnen til at udføre kommandolinjeopgaver, skrive shell-scripts og navigere i terminalmiljøer. Måler praktiske systemadministrations- og udviklingsworkflow-færdigheder. DeepSeek V4.1 Flash scorede 90.6% på denne benchmark.
ARC-AGI
11.4%
ARC-AGI: Abstraktion og ræsonnering. Abstraction and Reasoning Corpus for AGI - tester flydende intelligens gennem nye mønstergenkendelsespuslespil. Hver opgave kræver opdagelse af den underliggende regel fra eksempler, der måler generel ræsonneringsevne snarere end memorering. DeepSeek V4.1 Flash scorede 11.4% på denne benchmark.

Om DeepSeek V4.1 Flash

Lær om DeepSeek V4.1 Flashs muligheder, funktioner og hvordan den kan hjælpe dig med at opnå bedre resultater.

DeepSeek V4.1 Flash er en open-weight mixture-of-experts-model indeholdende i alt 552 milliarder parameters. Modellen introducerer en asymmetrisk kausal encoder-decoder-struktur designet til at minimere omkostningerne ved inference under højgennemstrømsarbejdsbelastninger. Under behandling af indkommende prompts aktiverer netværket kun 8 milliarder parameters, hvilket stiger til 16 milliarder under token-generering. Den underliggende backbone inkorporerer komprimeret nøgle-værdi-caching (KV-caching) delt på tværs af lag, en to-trins sparse indexer og en Engram-opslagshukommelse på 196 milliarder parameters, alt sammen trænet på et korpus på 45 billioner tokens.

I modsætning til tidligere iterationer i V4-familien kommer indbygget visuel forståelse som standard uden et separat vision-checkpoint. Modellen accepterer billeder direkte i standard tekstprompts og evaluerer visuelle artefakter såsom arkitekturdiagrammer, UI-layouts og tekniske tegninger. Parallelt hermed fungerer tænketilstanden (thinking mode) nativt og genererer eksklusive reasoning-spor, før der produceres færdige svar. Modellen kører med generationshastigheder mellem 300 og 427 tokens pr. sekund på moderne accelerator-klynger, hvilket matcher eller overgår latensprofilen for meget mindre tætte modeller, samtidig med at den bibeholder reasoning-kapacitet på ph.d.-niveau.

DeepSeek positionerede V4.1 Flash som en direkte erstatning for det større V4 Pro flagship. I tredjeparts-evalueringer, der spænder over frontend-generering, terminaloperationer og software-debugging, matchede eller overgik V4.1 Flash nøjagtigheden af V4 Pro, mens den kørte med lavere latens og mindre beregningsforbrug. Modellen betjener agentic-miljøer med store mængder data, automatiserede terminalværktøjer og kontinuerlige kodesyntese-workflows, hvor flagship API-priser typisk er uoverkommelige.

DeepSeek V4.1 Flash

Anvendelser for DeepSeek V4.1 Flash

Opdag de forskellige måder, du kan bruge DeepSeek V4.1 Flash til at opnå gode resultater.

Autonome terminal- og shell-operationer

Udfører systemdiagnostik, kører build-værktøjer og løser miljøfejl i containeriserede systemer og opnår en score på 90,6 på Terminal-Bench 2.1.

Full-stack UI- og frontend-prototyping

Genererer interaktive single-page-applikationer, WebGL shaders, Three.js 3D-miljøer og responsive dashboard-layouts fra enkeltstående tekst- eller billedprompts.

Kompleks multifils-code debugging

Scanner hele softwareprojekter på tværs af flere repositories inden for sit context window på 1 million tokens, sporer import på tværs af filer og retter inverteret logik eller race conditions.

Automatiseret visuel dokumentudtrækning

Inspekterer komplekse arkitekturtegninger, dataflyvningsdiagrammer og brugerflademockups for at spytte strukturerede JSON-skemaer og handlingsegnet API-kontrakter ud.

Høj-gennemstrømmes agentic tool calling

Kører kontinuerlige baggrundsloops med reasoning, der poller live REST-endpoints, forespørger i SQL-databaser og verificerer invariante tilstandsændringer på tværs af flere eksekveringsturns.

Flersproget oversættelse og dialektanalyse

Oversætter idiomer, regional slang og teknisk dokumentation på tværs af lavressourcedialekter, samtidig med at usikre oversættelser markeres i stedet for at hallucinere termer.

Styrker

Begrænsninger

Asymmetrisk MoE-effektivitet: Aktiverer kun 8B parameters ved input og 16B ved output ud af i alt 552B, hvilket holder inputprisen uden for myldretiden på $0,15 pr. million tokens.
Overtænkning af logik: Bruger overdrevent mange reasoning-tokens på ligetil kodningsprompts, hvis tændeindsatsen ikke begrænses af brugeren.
State-of-the-art agent-ydelse: Opnår 90,6% på Terminal-Bench 2.1 og 74,2% på DeepSWE v1.1, hvilket matcher eller overgår proprietære flagship-muligheder på ingeniøropgaver.
Innøjagtighed i kinematisk fysik: Producerer lejlighedsvise bevægelsesbanes-anomalier og tvivlsom fysik ved generering af komplekse 3D-kinematiske animationer i Three.js-tests.
Højgennemstrømsgenerering: Leverer verificerede dekrypteringshastigheder mellem 300 og 427 tokens pr. sekund, hvilket drastisk sænker svartiderne for agenter, der kræver meget reasoning.
Æstetiske UI-begrænsninger: Hænger efter proprietære flagship-modeller på sofistikeret typografi og afstand, og producerer funktionelle, men visuelt generiske dashboard-hierarkier.
Unified multimodal context: Indtager visuelle og tekst-tokens nativt inden for et context window på 1.000.000 tokens uden overhead fra sekundære vision-adaptere.
Uoverkommelige lokale hukommelseskrav: Kræver specialiserede multi-GPU-klyngeopsætninger for at passe til det massive 552B parameter-hukommelsesaftryk til fuld-præcision lokal hosting.

API hurtig start

deepseek/deepseek-v4.1-flash

Se dokumentation
deepseek SDK
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.deepseek.com",
  apiKey: process.env.DEEPSEEK_API_KEY,
});

async function main() {
  const completion = await client.chat.completions.create({
    model: "deepseek-flash",
    messages: [
      { role: "system", content: "You are an expert systems engineer." },
      { role: "user", content: "Write a high-performance WebGL compute shader." },
    ],
  });

  console.log(completion.choices[0].message.content);
}

main();

Installér SDK'et og begynd at foretage API-kald på få minutter.

Hvad folk siger om DeepSeek V4.1 Flash

Se hvad fællesskabet mener om DeepSeek V4.1 Flash

Den nåede 98% af GPT-6 Astra's score til 1,4% af prisen på hverdagslige designopgaver baseret på brugerforespørgsler. Hver eneste model undtagen Astra scorede lavere OG kostede mere.
OpenDesign (@OpenDesignHQ)
twitter
Deepseek V4.1 Flash 552B total, 8/16B aktiv med en ny arkitektur trænede på 45T tokens... det her er nok den mest nyskabende arkitektur, jeg har set længe, ret vildt.
Elie Bakouch (@eliebakouch)
twitter
Hastighed betyder meget mere, end folk tror, ærligt talt. Jeg ville tage en lidt dårligere model, der er 2x hurtigere til de fleste produkt-use cases.
MoneyLovesSpeed
hackernews
På et tidspunkt nåede den et vanvittigt peak på 427 tokens pr. sekund. Men det vildeste ved det er, at hele kørslen efter sigende kun kostede 30 cents.
WorldofAI
youtube
Det faktum, at V4 Pro-forespørgsler automatisk omdirigeres til V4.1 Flash, fortæller dig alt om, hvor god denne arkitektur faktisk er.
KevDev99
reddit
Terminal-Bench på 90,6 er vildt for en model i denne prisklasse. Agentic tooling er netop blevet radikalt billigere.
SysAdminHero
reddit

Videoer om DeepSeek V4.1 Flash

Se vejledninger, anmeldelser og diskussioner om DeepSeek V4.1 Flash

Denne nye DeepSeek version 4.1 flash-model er latterligt hurtig. Du får omkring 400 tokens pr. sekund, og hastigheden er helt ærligt sindssyg.

For en reasoning-model med dette funktionsniveau er den slags hastighed seriøst imponerende, især i betragtning af at dette bare er et midlertidigt testbuild.

På et tidspunkt nåede den et vanvittigt peak på 427 tokens pr. sekund. Men det vildeste ved det er, at hele kørslen efter sigende kun kostede 30 cents.

Test i den virkelige verden måler 300 til 400 plus tokens pr. sekund og rammer 98% af GPT6 Astra's design benchmark-score.

Den genererer ikke bare kode, den verificerer faktisk sin egen matematik. Den fangede endda selv en subtil fejl med omkredskontrol (orbit control).

vægte, og når den bliver udgivet i den færdige version, vil vi tjekke den ud. Igen, hvis du vil støtte kanalen, så bliv endelig medlem. Tak

At køre hele Artificial Analysis-testsuiten koster $72 med denne model. Det er 10 gange billigere end modeller med de samme intelligensscorer.

DeepSeek V4 Flash er faktisk den billigste af alle modellerne, og GPT 5.6 Luna, som koster det samme, er faktisk to point bagefter på intelligensindekset.

Jeg nyder helt bestemt denne tendens med, at kinesiske laboratorier kommer ind og underbyder de amerikanske laboratorier på prisen og samtidig matcher deres intelligens.

Mere end bare prompts

Supercharg din arbejdsgang med AI-automatisering

Automatio kombinerer kraften fra AI-agenter, webautomatisering og smarte integrationer for at hjælpe dig med at udrette mere på kortere tid.

AI-agenter
Webautomatisering
Smarte arbejdsgange

Pro-tips til DeepSeek V4.1 Flash

Eksperttips til at hjælpe dig med at få mest muligt ud af DeepSeek V4.1 Flash og opnå bedre resultater.

Styr reasoning-indsatsen

Indstil reasoning-indsatsen til low for simpel CRUD-generering og high eller max ved løsning af flertrinsmatematik eller komplekse fejl i kodebasen for at optimere token-forbruget.

Maksimer prompt caching

Gruppér efterfølgende systemprompts og statiske filreferencer tidligt i context window'et for at maksimere prompt cache-hits til prisen på $0,003/M uden for myldretiden.

Direkte multimodal input

Lever rå billeder og visuelle mockups direkte sammen med CSS-krav i stedet for manuelt at transskribere layoutspecifikationer for bedre rumlig nøjagtighed.

Brug officielle modelstrings

Brug den officielle deepseek-flash-modelstring i API-forespørgsler for at sikre automatisk routing til det nyeste aktive checkpoint og den mest effektive prissætning.

Anmeldelser

Hvad vores brugere siger

Slut dig til tusindvis af tilfredse brugere, der har transformeret deres arbejdsgang

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relateret AI Models

moonshot

Kimi k2.6

Moonshot

Kimi k2.6 is Moonshot AI's 1T-parameter MoE model featuring a 256K context window, native video input, and elite performance in autonomous agentic coding.

256K context
$0.95/$4.00/1M
anthropic

Claude Opus 4.6

Anthropic

Claude Opus 4.6 is Anthropic's flagship model featuring a 1M token context window, Adaptive Thinking, and world-class coding and reasoning performance.

1M context
$5.00/$25.00/1M
google

Gemini 3 Flash

Google

Gemini 3 Flash is Google's high-speed multimodal model featuring a 1M token context window, elite 90.4% GPQA reasoning, and autonomous browser automation tools.

1M context
$0.50/$3.00/1M
deepseek

DeepSeek v4

DeepSeek

DeepSeek v4 is a 1.6T parameter MoE model featuring a 1M token context window and native multimodal support for text, vision, and video at disruptive prices.

1M context
$1.74/$3.48/1M
anthropic

Claude Sonnet 4.6

Anthropic

Claude Sonnet 4.6 offers frontier performance for coding and computer use with a massive 1M token context window for only $3/1M tokens.

1M context
$3.00/$15.00/1M
google

Gemini 3 Pro

Google

Google's Gemini 3 Pro is a multimodal powerhouse featuring a 1M token context window, native video processing, and industry-leading reasoning performance.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M

Ofte stillede spørgsmål om DeepSeek V4.1 Flash

Find svar på almindelige spørgsmål om DeepSeek V4.1 Flash