deepseek

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash menawarkan context 1M, native vision, dan inference 400 tok/s dengan harga $0,15 per juta input token menggunakan arsitektur MoE asimetris.

Open WeightsMoEMultimodal VisionCode GenerationReasoning
deepseek logodeepseekDeepSeek V42026-09-10
Konteks
1Mtoken
Output maks.
384Ktoken
Harga input
$0.15/ 1M
Harga output
$0.60/ 1M
Modalitas:TextImage
Kemampuan:VisiAlatStreamingPenalaran
Benchmarks
GPQA
90.9%
GPQA: Tanya Jawab Sains Tingkat Doktoral. Benchmark ketat dengan 448 pertanyaan pilihan ganda dalam biologi, fisika, dan kimia yang dibuat oleh pakar domain. Para ahli PhD hanya mencapai akurasi 65-74%, sementara non-ahli hanya mendapat 34% bahkan dengan akses web tak terbatas (sehingga disebut 'tahan Google'). DeepSeek V4.1 Flash meraih skor 90.9% pada benchmark ini.
HLE
36.8%
HLE: Penalaran Keahlian Tingkat Tinggi. Menguji kemampuan model untuk mendemonstrasikan penalaran tingkat ahli di domain khusus. Mengevaluasi pemahaman mendalam tentang topik kompleks yang membutuhkan pengetahuan tingkat profesional. DeepSeek V4.1 Flash meraih skor 36.8% pada benchmark ini.
MMLU
91%
MMLU: Pemahaman Bahasa Multitugas Masif. Benchmark komprehensif dengan 16.000 pertanyaan pilihan ganda meliputi 57 mata pelajaran akademik termasuk matematika, filsafat, hukum, dan kedokteran. Menguji pengetahuan luas dan kemampuan penalaran. DeepSeek V4.1 Flash meraih skor 91% pada benchmark ini.
MMLU Pro
81.2%
MMLU Pro: MMLU Edisi Profesional. Versi MMLU yang ditingkatkan dengan 12.032 pertanyaan menggunakan format 10 pilihan yang lebih sulit. Mencakup Matematika, Fisika, Kimia, Hukum, Teknik, Ekonomi, Kesehatan, Psikologi, Bisnis, Biologi, Filsafat, dan Ilmu Komputer. DeepSeek V4.1 Flash meraih skor 81.2% pada benchmark ini.
SimpleQA
49%
SimpleQA: Benchmark Akurasi Faktual. Menguji kemampuan model untuk memberikan respons yang akurat dan faktual terhadap pertanyaan langsung. Mengukur keandalan dan mengurangi halusinasi dalam tugas pengambilan pengetahuan. DeepSeek V4.1 Flash meraih skor 49% pada benchmark ini.
IFEval
89.5%
IFEval: Evaluasi Kepatuhan Instruksi. Mengukur seberapa baik model mengikuti instruksi dan batasan tertentu. Menguji kemampuan untuk mematuhi aturan format, batas panjang, dan persyaratan eksplisit lainnya. DeepSeek V4.1 Flash meraih skor 89.5% pada benchmark ini.
AIME 2025
87.5%
AIME 2025: Ujian Matematika Undangan Amerika. Soal matematika tingkat kompetisi dari ujian AIME bergengsi yang dirancang untuk siswa SMA berbakat. Menguji pemecahan masalah matematika tingkat lanjut yang membutuhkan penalaran abstrak, bukan sekadar pencocokan pola. DeepSeek V4.1 Flash meraih skor 87.5% pada benchmark ini.
MATH
88.5%
MATH: Pemecahan Masalah Matematika. Benchmark matematika komprehensif yang menguji pemecahan masalah dalam aljabar, geometri, kalkulus, dan domain matematika lainnya. Membutuhkan penalaran multi-langkah dan pengetahuan matematika formal. DeepSeek V4.1 Flash meraih skor 88.5% pada benchmark ini.
GSM8k
96.8%
GSM8k: Matematika SD 8K. 8.500 soal cerita matematika tingkat SD yang membutuhkan penalaran multi-langkah. Menguji aritmatika dasar dan pemikiran logis melalui skenario dunia nyata seperti belanja atau perhitungan waktu. DeepSeek V4.1 Flash meraih skor 96.8% pada benchmark ini.
MGSM
92%
MGSM: Matematika SD Multibahasa. Benchmark GSM8k yang diterjemahkan ke 10 bahasa termasuk Spanyol, Prancis, Jerman, Rusia, Cina, dan Jepang. Menguji penalaran matematika dalam berbagai bahasa. DeepSeek V4.1 Flash meraih skor 92% pada benchmark ini.
MathVista
72.5%
MathVista: Penalaran Matematika Visual. Menguji kemampuan untuk menyelesaikan masalah matematika yang melibatkan elemen visual seperti grafik, diagram geometri, dan figur ilmiah. Menggabungkan pemahaman visual dengan penalaran matematika. DeepSeek V4.1 Flash meraih skor 72.5% pada benchmark ini.
SWE-Bench
74.2%
SWE-Bench: Benchmark Rekayasa Perangkat Lunak. Model AI mencoba menyelesaikan masalah GitHub nyata dalam proyek Python open-source dengan verifikasi manusia. Menguji keterampilan rekayasa perangkat lunak praktis pada codebase produksi. Model terbaik meningkat dari 4,4% di 2023 menjadi lebih dari 70% di 2024. DeepSeek V4.1 Flash meraih skor 74.2% pada benchmark ini.
HumanEval
92.5%
HumanEval: Masalah Pemrograman Python. 164 masalah pemrograman yang ditulis tangan di mana model harus menghasilkan implementasi fungsi Python yang benar. Setiap solusi diverifikasi dengan unit test. Model terbaik sekarang mencapai akurasi lebih dari 90%. DeepSeek V4.1 Flash meraih skor 92.5% pada benchmark ini.
LiveCodeBench
73.3%
LiveCodeBench: Benchmark Koding Langsung. Menguji kemampuan koding pada tantangan pemrograman dunia nyata yang terus diperbarui. Berbeda dengan benchmark statis, menggunakan masalah baru untuk mencegah kontaminasi data dan mengukur keterampilan koding yang sebenarnya. DeepSeek V4.1 Flash meraih skor 73.3% pada benchmark ini.
MMMU
78.9%
MMMU: Pemahaman Multimodal. Benchmark Pemahaman Multimodal Multi-disiplin Masif yang menguji model penglihatan-bahasa pada masalah tingkat universitas di 30 mata pelajaran yang membutuhkan pemahaman gambar dan pengetahuan ahli. DeepSeek V4.1 Flash meraih skor 78.9% pada benchmark ini.
MMMU Pro
58.4%
MMMU Pro: MMMU Edisi Profesional. Versi MMMU yang ditingkatkan dengan pertanyaan lebih sulit dan evaluasi lebih ketat. Menguji penalaran multimodal tingkat lanjut di tingkat profesional dan ahli. DeepSeek V4.1 Flash meraih skor 58.4% pada benchmark ini.
ChartQA
88%
ChartQA: Tanya Jawab Grafik. Menguji kemampuan untuk memahami dan bernalar tentang informasi yang disajikan dalam grafik dan diagram. Membutuhkan ekstraksi data, perbandingan nilai, dan melakukan perhitungan dari representasi visual data. DeepSeek V4.1 Flash meraih skor 88% pada benchmark ini.
DocVQA
93%
DocVQA: Tanya Jawab Visual Dokumen. Benchmark Tanya Jawab Visual Dokumen yang menguji kemampuan untuk mengekstrak dan bernalar tentang informasi dari gambar dokumen termasuk formulir, laporan, dan teks yang dipindai. DeepSeek V4.1 Flash meraih skor 93% pada benchmark ini.
Terminal-Bench
90.6%
Terminal-Bench: Tugas Terminal/CLI. Menguji kemampuan untuk melakukan operasi baris perintah, menulis skrip shell, dan menavigasi lingkungan terminal. Mengukur keterampilan administrasi sistem praktis dan alur kerja pengembangan. DeepSeek V4.1 Flash meraih skor 90.6% pada benchmark ini.
ARC-AGI
11.4%
ARC-AGI: Abstraksi dan Penalaran. Abstraction and Reasoning Corpus untuk AGI - menguji kecerdasan fluida melalui teka-teki pengenalan pola baru. Setiap tugas membutuhkan penemuan aturan yang mendasari dari contoh, mengukur kemampuan penalaran umum daripada menghafal. DeepSeek V4.1 Flash meraih skor 11.4% pada benchmark ini.

Tentang DeepSeek V4.1 Flash

Pelajari tentang kemampuan, fitur, dan cara menggunakan DeepSeek V4.1 Flash.

DeepSeek V4.1 Flash adalah model mixture-of-experts open-weight yang berisi total 552 miliar parameter. Model ini memperkenalkan struktur encoder-decoder kausal asimetris yang dirancang untuk meminimalkan biaya inference selama workload ber-throughput tinggi. Saat memproses prompt yang masuk, jaringan ini hanya mengaktivasi 8 miliar parameter, dan meningkat menjadi 16 miliar selama pembuatan token. Tulang punggung (backbone) di dalamnya menggabungkan key-value caching terkompresi yang dibagikan di berbagai layer, indeks sparse dua tahap, dan memori pencarian Engram 196 miliar parameter, yang semuanya dilatih pada korpus 45 triliun token.

Tidak seperti iterasi sebelumnya dalam keluarga V4, pemahaman visual secara native sudah disertakan sebagai standar tanpa memerlukan checkpoint vision terpisah. Model ini menerima gambar secara langsung di dalam prompt teks standar dan mengevaluasi artifak visual seperti diagram arsitektur, layout UI, dan diagram teknis. Secara paralel, mode thinking beroperasi secara native, menghasilkan jejak reasoning eksplisit sebelum menghasilkan jawaban final. Model ini beroperasi pada kecepatan generasi antara 300 dan 427 token per detik pada cluster akselerator modern, menyamai atau melampaui profil latensi dari model dense yang jauh lebih kecil sambil tetap mempertahankan kapabilitas reasoning tingkat PhD.

DeepSeek memosisikan V4.1 Flash sebagai pengganti langsung untuk model flagship V4 Pro yang lebih besar. Dalam evaluasi pihak ketiga yang mencakup pembuatan frontend, operasi terminal, dan debugging software, V4.1 Flash memenuhi atau melampaui akurasi V4 Pro sembari beroperasi pada latensi dan biaya komputasi yang lebih rendah. Model ini melayani environment agentic volume tinggi, tooling terminal otomatis, dan alur kerja sintesis kode berkelanjutan di mana harga API model flagship biasanya terlalu mahal.

DeepSeek V4.1 Flash

Kasus Penggunaan untuk DeepSeek V4.1 Flash

Temukan berbagai cara menggunakan DeepSeek V4.1 Flash untuk hasil yang luar biasa.

Operasi Shell dan Terminal Otonom

Mengeksekusi diagnostik sistem, menjalankan tool build, dan mengatasi error environment di dalam sistem terkontainerisasi, serta mencapai skor 90,6 pada Terminal-Bench 2.1.

Pembuatan Prototipe UI Full-Stack dan Frontend

Menghasilkan aplikasi single-page interaktif, shader WebGL, environment 3D Three.js, dan layout dashboard responsif dari prompt teks atau gambar sekali jalan.

Debugging Kode Multi-File yang Kompleks

Memindai seluruh proyek software multi-repositori dalam context window 1 juta token, melacak impor lintas file, dan memperbaiki logika yang terbalik atau race condition.

Ekstraksi Dokumen Visual Otomatis

Memeriksa blueprint arsitektur yang kompleks, diagram alur data, dan mockup antarmuka pengguna untuk menghasilkan skema JSON terstruktur serta kontrak API yang dapat ditindaklanjuti.

Pemanggilan Tool Agentic Ber-Throughput Tinggi

Menjalankan loop reasoning latar belakang secara kontinu yang melakukan polling endpoint REST langsung, kueri database SQL, dan memverifikasi perubahan state invarian di beberapa turn eksekusi.

Terjemahan Multibahasa dan Analisis Dialek

Menerjemahkan idiom, slang regional, dan dokumentasi teknis di berbagai dialek sumber daya rendah sambil menandai terjemahan yang tidak pasti alih-alih melakukan halusinasi istilah.

Kelebihan

Keterbatasan

Efisiensi MoE Asimetris: Hanya mengaktivasi 8B parameters pada input dan 16B pada output dari total 552B, menjaga harga input di luar jam sibuk tetap pada $0,15 per juta token.
Berpikir Terlalu Rumit (Overthinking Logika): Menghabiskan token reasoning secara berlebihan pada prompt koding yang sederhana jika thinking effort dibiarkan tanpa batasan oleh pengguna.
Performa Agen State-of-the-Art: Mencapai 90,6% pada Terminal-Bench 2.1 dan 74,2% pada DeepSWE v1.1, menyamai atau melampaui opsi proprietary flagship pada tugas-tugas engineering.
Ketidakakuratan Fisika Kinematik: Menghasilkan anomali jalur gerak sesekali dan fisika yang meragukan saat membuat animasi kinematik 3D yang kompleks dalam pengujian Three.js.
Generasi Ber-Throughput Tinggi: Memberikan kecepatan decoding terverifikasi antara 300 dan 427 token per detik, secara drastis menurunkan waktu tunggu untuk agent yang padat reasoning.
Keterbatasan Estetika UI: Tertinggal dari model flagship proprietary pada tipografi dan tata letak tingkat lanjut, menghasilkan hierarki dashboard yang fungsional tetapi secara visual tampak generik.
Context Multimodal yang Terpadu: Memproses token visual dan teks secara native dalam context window 1.000.000 token tanpa overhead dari adapter vision sekunder.
Persyaratan Memori Lokal yang Sangat Besar: Memerlukan konfigurasi cluster multi-GPU khusus untuk memuat footprint memori parameter 552B yang masif untuk hosting lokal presisi penuh.

Mulai Cepat API

deepseek/deepseek-v4.1-flash

Lihat Dokumentasi
deepseek SDK
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.deepseek.com",
  apiKey: process.env.DEEPSEEK_API_KEY,
});

async function main() {
  const completion = await client.chat.completions.create({
    model: "deepseek-flash",
    messages: [
      { role: "system", content: "You are an expert systems engineer." },
      { role: "user", content: "Write a high-performance WebGL compute shader." },
    ],
  });

  console.log(completion.choices[0].message.content);
}

main();

Instal SDK dan mulai melakukan panggilan API dalam hitungan menit.

Apa Kata Orang Tentang DeepSeek V4.1 Flash

Lihat apa yang dipikirkan komunitas tentang DeepSeek V4.1 Flash

Model ini mencapai 98% dari skor GPT-6 Astra dengan biaya 1,4% pada tugas-tugas desain sehari-hari berdasarkan permintaan pengguna. Semua model kecuali Astra mendapat skor lebih rendah DAN berbiaya lebih mahal.
OpenDesign (@OpenDesignHQ)
twitter
Deepseek V4.1 Flash total 552B, aktif 8/16B dengan arsitektur baru yang dilatih pada 45T token... ini mungkin arsitektur paling inovatif yang pernah saya lihat dalam beberapa waktu terakhir, sangat luar biasa.
Elie Bakouch (@eliebakouch)
twitter
Kecepatan jauh lebih penting daripada yang dipikirkan orang. Jujur saya akan memilih model yang sedikit lebih buruk tetapi 2x lebih cepat untuk sebagian besar use case produk.
MoneyLovesSpeed
hackernews
Pada satu titik, kecepatannya melonjak hingga mencapai 427 token per detik yang gila. Namun, bagian paling gila dari ini adalah seluruh eksekusi tersebut dilaporkan hanya menghabiskan 30 sen.
WorldofAI
youtube
Fakta bahwa kueri V4 Pro secara otomatis diarahkan ulang ke V4.1 Flash memberi tahu Anda segalanya tentang seberapa bagus arsitektur ini sebenarnya.
KevDev99
reddit
Terminal-Bench di angka 90,6 sangat luar biasa untuk model pada tier harga ini. Tooling agentic menjadi jauh lebih murah.
SysAdminHero
reddit

Video Tentang DeepSeek V4.1 Flash

Tonton tutorial, ulasan, dan diskusi tentang DeepSeek V4.1 Flash

Model DeepSeek versi 4.1 flash baru ini sangat cepat secara tidak masuk akal. Anda mendapatkan sekitar 400 token per detik, dan kecepatannya jujur sangat gila.

Untuk sebuah model reasoning dengan tingkat kemampuan seperti ini, kecepatan seperti itu sangat mengesankan, terutama mengingat ini hanyalah build uji coba sementara.

Pada satu titik, kecepatannya melonjak hingga mencapai 427 token per detik yang gila. Namun, bagian paling gila dari ini adalah seluruh eksekusi tersebut dilaporkan hanya menghabiskan biaya 30 sen.

Pengujian dunia nyata mencatatkan 300 hingga 400 plus token per detik, mencapai 98% dari skor benchmark desain GPT6 Astra.

Model ini tidak hanya menghasilkan kode tetapi benar-benar memverifikasi matematikanya sendiri. Model ini bahkan menemukan bug kontrol orbit yang halus secara mandiri.

bobotnya dan begitu dirilis dalam versi akhir kita akan memeriksanya. Sekali lagi jika Anda ingin mendukung channel ini silakan menjadi member. Terima

Untuk menjalankan seluruh suite pengujian Artificial Analysis, biayanya adalah $72 dengan model ini. Itu 10 kali lebih murah daripada model dengan skor inteligensi yang sama.

DeepSeek V4 Flash sebenarnya adalah yang paling murah dari semua model, dan GPT 5.6 Luna yang harganya sama sebenarnya tertinggal dua poin pada Intelligence Index.

Saya tentu menikmati tren laboratorium asal Tiongkok yang masuk dan menawarkan harga di bawah laboratorium AS sekaligus menyamai tingkat kecerdasan mereka.

Lebih dari sekadar prompt

Tingkatkan alur kerja Anda dengan Otomatisasi AI

Automatio menggabungkan kekuatan agen AI, otomatisasi web, dan integrasi cerdas untuk membantu Anda mencapai lebih banyak dalam waktu lebih singkat.

Agen AI
Otomasi Web
Alur Kerja Cerdas

Tips Pro untuk DeepSeek V4.1 Flash

Tips ahli untuk memaksimalkan DeepSeek V4.1 Flash.

Kelola Effort Reasoning

Atur effort reasoning ke low untuk pembuatan CRUD sederhana dan ke high atau max saat menyelesaikan matematika multi-langkah atau bug codebase yang kompleks guna mengoptimalkan penggunaan token.

Maksimalkan Prompt Caching

Kelompokkan system prompt berurutan dan referensi file statis di awal context window untuk memaksimalkan cache hit prompt pada tarif di luar jam sibuk $0,003/M.

Input Multimodal Langsung

Berikan gambar mentah dan mockup visual secara langsung bersamaan dengan persyaratan CSS alih-alih menulis ulang spesifikasi layout secara manual untuk akurasi spasial yang lebih baik.

Gunakan String Model Resmi

Gunakan string model deepseek-flash resmi dalam permintaan API untuk memastikan perutean otomatis ke checkpoint aktif terbaru dan penetapan harga yang paling efisien.

Testimoni

Apa Kata Pengguna Kami

Bergabunglah dengan ribuan pengguna puas yang telah mengubah alur kerja mereka

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Terkait AI Models

moonshot

Kimi k2.6

Moonshot

Kimi k2.6 is Moonshot AI's 1T-parameter MoE model featuring a 256K context window, native video input, and elite performance in autonomous agentic coding.

256K context
$0.95/$4.00/1M
anthropic

Claude Opus 4.6

Anthropic

Claude Opus 4.6 is Anthropic's flagship model featuring a 1M token context window, Adaptive Thinking, and world-class coding and reasoning performance.

1M context
$5.00/$25.00/1M
google

Gemini 3 Flash

Google

Gemini 3 Flash is Google's high-speed multimodal model featuring a 1M token context window, elite 90.4% GPQA reasoning, and autonomous browser automation tools.

1M context
$0.50/$3.00/1M
deepseek

DeepSeek v4

DeepSeek

DeepSeek v4 is a 1.6T parameter MoE model featuring a 1M token context window and native multimodal support for text, vision, and video at disruptive prices.

1M context
$1.74/$3.48/1M
anthropic

Claude Sonnet 4.6

Anthropic

Claude Sonnet 4.6 offers frontier performance for coding and computer use with a massive 1M token context window for only $3/1M tokens.

1M context
$3.00/$15.00/1M
google

Gemini 3 Pro

Google

Google's Gemini 3 Pro is a multimodal powerhouse featuring a 1M token context window, native video processing, and industry-leading reasoning performance.

1M context
$2.00/$12.00/1M
alibaba

Qwen 3.7 Max

alibaba

Qwen 3.7 Max is Alibaba’s flagship AI model for deep reasoning and autonomous agent tasks, featuring a 256k context window and top-tier coding performance.

256K context
$1.20/$6.00/1M
openai

GPT-5.2 Pro

OpenAI

GPT-5.2 Pro is OpenAI's 2025 flagship reasoning model featuring Extended Thinking for SOTA performance in mathematics, coding, and expert knowledge work.

400K context
$21.00/$168.00/1M

Pertanyaan yang Sering Diajukan tentang DeepSeek V4.1 Flash

Temukan jawaban untuk pertanyaan umum tentang DeepSeek V4.1 Flash