google

Gemini 3.8 Flash

Gemini 3.8 Flash là AI multimodal của Google cung cấp context 1M, output 64K và khả năng lập trình agentic với giá $0.75 mỗi triệu input token.

MultimodalTốc độ caoGoogle DeepMindContext dàiLập trình Agentic
google logogoogleGemini 32026-09-02
Ngu canh
1Mtoken
Dau ra toi da
66Ktoken
Gia dau vao
$0.75/ 1M
Gia dau ra
$3.75/ 1M
Phuong thuc:TextImageAudioVideo
Kha nang:Thi giacCong cuTruyen truc tiepSuy luan
Diem chuan
GPQA
59%
GPQA: Cau hoi khoa hoc cap sau dai hoc. Benchmark nghiem ngat voi 448 cau hoi ve sinh hoc, vat ly va hoa hoc. Chuyen gia PhD chi dat 65-74% do chinh xac. Gemini 3.8 Flash dat 59% trong benchmark nay.
HLE
45.4%
HLE: Suy luan cap chuyen gia. Kiem tra kha nang mo hinh the hien suy luan cap chuyen gia trong cac linh vuc chuyen mon. Gemini 3.8 Flash dat 45.4% trong benchmark nay.
MMLU
88.2%
MMLU: Hieu ngon ngu da nhiem voc lon. Benchmark toan dien voi 16.000 cau hoi tren 57 mon hoc. Gemini 3.8 Flash dat 88.2% trong benchmark nay.
MMLU Pro
76.5%
MMLU Pro: MMLU Phien ban chuyen nghiep. Phien ban nang cap cua MMLU voi 12.032 cau hoi va dinh dang 10 lua chon kho hon. Gemini 3.8 Flash dat 76.5% trong benchmark nay.
SimpleQA
42%
SimpleQA: Benchmark do chinh xac thuc te. Kiem tra kha nang mo hinh cung cap cau tra loi chinh xac, thuc te. Gemini 3.8 Flash dat 42% trong benchmark nay.
IFEval
87.5%
IFEval: Danh gia tuan theo huong dan. Do luong mo hinh tuan theo huong dan va rang buoc cu the tot nhu the nao. Gemini 3.8 Flash dat 87.5% trong benchmark nay.
AIME 2025
82%
AIME 2025: Ky thi toan hoc moi My. Bai toan toan hoc cap do thi dau tu ky thi AIME uy tin. Gemini 3.8 Flash dat 82% trong benchmark nay.
MATH
78%
MATH: Giai quyet van de toan hoc. Benchmark toan hoc toan dien kiem tra giai quyet van de trong dai so, hinh hoc, giai tich. Gemini 3.8 Flash dat 78% trong benchmark nay.
GSM8k
94%
GSM8k: Toan tieu hoc 8K. 8.500 bai toan dang van ban cap tieu hoc. Gemini 3.8 Flash dat 94% trong benchmark nay.
MGSM
91%
MGSM: Toan tieu hoc da ngon ngu. Benchmark GSM8k duoc dich sang 10 ngon ngu. Gemini 3.8 Flash dat 91% trong benchmark nay.
MathVista
68%
MathVista: Suy luan thi giac toan hoc. Kiem tra kha nang giai quyet bai toan toan hoc voi cac yeu to thi giac. Gemini 3.8 Flash dat 68% trong benchmark nay.
SWE-Bench
49%
SWE-Bench: Benchmark ky thuat phan mem. Cac mo hinh AI co gang giai quyet van de GitHub thuc trong cac du an Python. Gemini 3.8 Flash dat 49% trong benchmark nay.
HumanEval
85%
HumanEval: Bai tap lap trinh Python. 164 bai tap lap trinh yeu cau mo hinh tao ra cac trien khai ham Python dung. Gemini 3.8 Flash dat 85% trong benchmark nay.
LiveCodeBench
65%
LiveCodeBench: Benchmark lap trinh truc tiep. Kiem tra kha nang lap trinh tren cac thach thuc lap trinh thuc te cap nhat lien tuc. Gemini 3.8 Flash dat 65% trong benchmark nay.
MMMU
69.5%
MMMU: Hieu da phuong thuc. Benchmark hieu da phuong thuc tren 30 mon hoc dai hoc. Gemini 3.8 Flash dat 69.5% trong benchmark nay.
MMMU Pro
52%
MMMU Pro: MMMU Phien ban chuyen nghiep. Phien ban nang cap cua MMMU voi cac cau hoi kho hon. Gemini 3.8 Flash dat 52% trong benchmark nay.
ChartQA
86%
ChartQA: Hoi dap bieu do. Kiem tra kha nang hieu va phan tich thong tin tu bieu do va do thi. Gemini 3.8 Flash dat 86% trong benchmark nay.
DocVQA
93.5%
DocVQA: Hoi dap thi giac tai lieu. Kiem tra kha nang trich xuat thong tin tu hinh anh tai lieu. Gemini 3.8 Flash dat 93.5% trong benchmark nay.
Terminal-Bench
89.4%
Terminal-Bench: Tac vu terminal/CLI. Kiem tra kha nang thuc hien cac thao tac dong lenh. Gemini 3.8 Flash dat 89.4% trong benchmark nay.
ARC-AGI
4%
ARC-AGI: Truu tuong va suy luan. Kiem tra tri thong minh linh hoat thong qua cac cau do nhan dang mau moi. Gemini 3.8 Flash dat 4% trong benchmark nay.

Ve Gemini 3.8 Flash

Tim hieu ve kha nang cua Gemini 3.8 Flash, tinh nang va cach no co the giup ban dat ket qua tot hon.

Tổng quan về Model

Gemini 3.8 Flash là model multimodal hiệu suất cao của Google DeepMind được phát hành vào tháng 9 năm 2026. Được xây dựng trên phần cứng Tensor Processing Unit của Google, hệ thống này tiếp nhận nguyên bản văn bản, âm thanh, hình ảnh độ phân giải cao và các luồng video dài tới hai giờ trong một context window duy nhất gồm 1.048.576 token. Dung lượng output đạt tới 65.536 token cho mỗi request. Model giới thiệu các ngân sách lý luận có thể cấu hình thông qua các tham số thấp, trung bình và cao, cho phép các kỹ sư cân bằng giữa độ trễ thực thi và mức độ tiêu thụ token.

Thực thi Agentic và Kiến trúc

Model hướng tới các tác vụ lập trình dài hạn và điều khiển terminal. Thay vì kết thúc sau một lần truyền output, Gemini 3.8 Flash hỗ trợ các vòng lặp thực thi đệ quy và tương tác công cụ tự động. Quá trình huấn luyện nhấn mạnh vào việc thao tác container, giao diện dòng lệnh và các khối lượng công việc phòng thủ an ninh mạng. Quá trình huấn luyện này mang lại tỷ lệ lỗi thấp hơn trên các bộ test và khả năng tự sửa lỗi trong quá trình build trực tiếp trong các môi trường như Google Antigravity.

Khối lượng công việc Sản xuất và Grounding

Các lập trình viên triển khai Gemini 3.8 Flash cho các ứng dụng nhạy cảm với độ trễ yêu cầu việc sử dụng công cụ mang tính tất định. Các tích hợp nguyên bản kết nối trực tiếp model với tính năng grounding của Google Search và dữ liệu Google Maps mà không cần các pipeline truy xuất riêng biệt. Trong khi các model flagship vẫn duy trì lợi thế trong các tác vụ sáng tạo mở, 3.8 Flash mang lại điểm số đánh giá lập trình tương đương với mức giá inference thấp hơn.

Gemini 3.8 Flash

Truong hop su dung cho Gemini 3.8 Flash

Kham pha cac cach khac nhau ban co the su dung Gemini 3.8 Flash de dat ket qua tuyet voi.

Bảo trì Terminal Tự động

Thực hiện refactor đa file, chạy các bộ test bên trong môi trường container và tự động vá các lỗi runtime.

Tiếp nhận Video Khối lượng lớn

Phân tích các bản ghi video và stream audio thô dài hai giờ trực tiếp trong context window 1M token mà không cần pipeline tiền xử lý bên ngoài.

Trích xuất Báo cáo Tài chính

Đọc các hồ sơ tài chính dài và các file PDF trực quan phức tạp để tính toán các chỉ số bảng cân đối kế toán thành định dạng JSON đã được kiểm tra.

Tạo mẫu UI Nhanh chóng

Tạo ra các ứng dụng web hoàn chỉnh, bảng điều khiển SVG tương tác và các mô phỏng WebGL trong vòng chưa đầy mười lăm giây.

Xác thực Bảo mật Phòng thủ

Quét kho lưu trữ mã nguồn để xác định các lỗ hổng logic, theo dõi các biến bị nhiễm độc và tạo các bản vá hồi quy tiềm năng.

Điều phối Agent Độ trễ thấp

Đóng vai trò là trình lập kế hoạch hành động nhanh trong các thiết lập đa agent phân cấp, gọi các công cụ bên ngoài được neo giữ bởi Google Search.

Diem manh

Han che

Kinh tế Lập trình Agentic: Đạt 73.7% trên DeepSWE v1.1 và 89.4% trên Terminal-Bench 2.1 với chi phí mở đầu là $0.75 cho mỗi triệu input token.
Tiêu thụ Token Cao khi Tư duy Sâu: Các cấu hình lý luận cao thực hiện các vòng lặp nội bộ kéo dài làm tăng output token lên tới 30% so với 3.7 Flash.
Khả năng Multimodal Long-Context Nguyên bản: Xử lý lên đến 1.048.576 token kết hợp từ audio, video và text mà không cần pipeline trích xuất frame bên ngoài.
Độ chính xác Thấp hơn trên các Terminal Benchmark Phức tạp: Đạt 19.1% trên Terminal-Bench 4.0, đứng sau các frontier model lớn hơn như Claude Opus 5 trong các tác vụ container phức tạp.
Ngân sách Lý luận Có thể Cấu hình: Cung cấp các mức độ tư duy thấp, trung bình và cao để lập trình viên có thể điều chỉnh độ trễ token và độ sâu theo yêu cầu.
Cải thiện Lý luận trong Kỳ thi Không đáng kể: Lý luận khoa học tổng quát cho thấy sự thay đổi không đáng kể, đạt 45.4% trên Humanity's Last Exam so với 45.7% của 3.7 Flash.
Tích hợp Công cụ Có Neo (Grounded): Kết nối nguyên bản với Google Search và Google Maps API để cung cấp câu trả lời thực tế có thể xác minh với tỷ lệ ảo giác thấp.
Tăng Giá theo Lịch trình: Giá ưu đãi sẽ hết hạn vào ngày 31 tháng 12 năm 2026, làm tăng gấp đôi chi phí lên $1.50 cho input và $7.50 cho output mỗi triệu token.

Bat dau nhanh API

google/gemini-3.8-flash

Xem tai lieu
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({ apiKey: process.env.GEMINI_API_KEY });

async function main() {
  const response = await ai.models.generateContent({
    model: "gemini-3.8-flash",
    contents: "Analyze this code repository structure for memory leaks.",
    config: {
      maxOutputTokens: 8192,
      thinkingConfig: { thinkingBudget: 2048 }
    }
  });
  console.log(response.text);
}

main();

Cai dat SDK va bat dau thuc hien cac cuoc goi API trong vai phut.

Moi nguoi dang noi gi ve Gemini 3.8 Flash

Xem cong dong nghi gi ve Gemini 3.8 Flash

Gemini 3.8 Flash là một bước tiến nữa về năng lực agentic... model Flash cập nhật thứ 3 của chúng tôi chỉ trong vòng 6 tuần.
Logan Kilpatrick
twitter
Tốc độ kết hợp với việc model này thực sự giỏi về địa lý và kỹ năng không gian địa lý khiến nó trở nên tuyệt vời.
MapDev
hackernews
Gemini 3.8 Flash đứng đầu benchmark Redactle LLM... model này cũng thực hiện các bài đánh giá rẻ hơn và nhanh hơn hầu hết các model khác.
PuzzleSolver
reddit
Tôi sử dụng chính antigravity cho công việc. Trong năm qua, chúng tôi đã chuyển từ việc mất vài phút sang việc tạo ra công việc gần như hoàn hảo trong 10 giây.
SaaSBuilder
hackernews
Gemini Flash 3.8 đánh bại Opus 5 với mức giá thấp hơn 15 lần trong bốn tác vụ vật lý three.js độc lập.
GraphicsCoder
twitter
Context window 1M xử lý video trực tiếp mà không cần chuyển đổi thành hình ảnh trước giúp tiết kiệm rất nhiều công sức kỹ thuật.
VideoAIPro
reddit

Video ve Gemini 3.8 Flash

Xem huong dan, danh gia va thao luan ve Gemini 3.8 Flash

Deep SUI V1.1 Gemini 3.8 Flash đạt 73.7%... thực sự ngang ngửa với Claude Opus 5 vừa mới được phát hành

Tiếp theo chúng ta có terminal bench 2.1. Nó đạt điểm số số một là 89.4. Đây là lập trình terminal dạng agentic

tốt. Vì vậy, Claude Opus 5 hoàn toàn thống trị đối thủ, đạt 1824, vị trí thứ hai là 1710 cho GPT 5.6 Soul, và sau đó là điểm số kém ấn tượng hơn một chút là 1545 cho Gemini 3.8 Flash. Vì vậy

Theo chỉ số trí tuệ nhân tạo, nó cơ bản nằm ở biên Pareto của chi phí so với hiệu suất

So với model flash trước đó của Gemini, model này ngốn nhiều token hơn đáng kể cho một tác vụ cụ thể... tăng lên tới 30%

Đối với việc tạo token, bạn có thể mong đợi lên tới 300 token mỗi giây theo Chỉ số Trí tuệ Nhân tạo.

Thật sự rất ấn tượng khi ở mức giá này bạn lại nhận được mức độ thông minh ngang ngửa Opus 5

Vấn đề lớn của Gemini đã được giải quyết đó là nó không thêm quá nhiều nội dung rác trên trang web

Và các bạn, đừng nhầm lẫn, đây là một model ấn tượng vì cứ vài tuần chúng ta lại thấy các model mới từ Gemini như 3.6, 3.7 Flash và bây giờ là 3.8 Flash.

Hon ca prompt

Tang cuong quy trinh lam viec cua ban voi Tu dong hoa AI

Automatio ket hop suc manh cua cac AI agent, tu dong hoa web va tich hop thong minh de giup ban lam duoc nhieu hon trong thoi gian ngan hon.

AI Agent
Tu dong hoa web
Quy trinh thong minh

Meo chuyen nghiep cho Gemini 3.8 Flash

Meo chuyen gia giup ban tan dung toi da Gemini 3.8 Flash va dat ket qua tot hon.

Chọn mức độ tư duy một cách tường minh

Cấu hình mức nỗ lực tư duy (thinking effort) ở mức thấp cho việc chuyển đổi dữ liệu có cấu trúc hoặc cao cho việc gỡ lỗi terminal nhằm kiểm soát việc sử dụng token.

Bật Context Caching

Kích hoạt tính năng context caching của Gemini API trên các prompt vượt quá 32.000 token để giảm chi phí input lên tới 75 phần trăm.

Neo truy vấn với các công cụ gốc

Khai báo trực tiếp các công cụ Google Search và Maps trong request để lấy các thông tin thực tế đã được xác thực và dữ liệu gần đây.

Cung cấp phản hồi trình biên dịch trực tiếp

Đưa output từ trình biên dịch và trình chạy thử nghiệm trở lại model để model có thể tự động sửa lỗi cú pháp và logic trong vòng lặp.

Danh gia

Nguoi dung cua chung toi noi gi

Tham gia cung hang nghin nguoi dung hai long da thay doi quy trinh lam viec cua ho

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Lien quan AI Models

deepseek

DeepSeek-V3.2-Speciale

DeepSeek

DeepSeek-V3.2-Speciale is a reasoning-first LLM featuring gold-medal math performance, DeepSeek Sparse Attention, and a 131K context window. Rivaling GPT-5...

131K context
$0.28/$0.42/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
deepseek

DeepSeek-V4-Flash

DeepSeek

DeepSeek-V4-Flash is an open-weight 1M context AI model scoring 54.4% on SWE-bench at $0.14 per 1M tokens, optimized for agentic coding and reasoning.

1M context
$0.14/$0.28/1M
moonshot

Kimi K2.7 Code

Moonshot

Kimi K2.7 Code is a 1T parameter MoE model from Moonshot AI. It features a 262k context window and 30% more efficient reasoning for software engineering.

262K context
$0.95/$4.00/1M
anthropic

Claude 3.7 Sonnet

Anthropic

Claude 3.7 Sonnet is Anthropic's first hybrid reasoning model, delivering state-of-the-art coding capabilities, a 200k context window, and visible thinking.

200K context
$3.00/$15.00/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
google

Gemini 3.5 Flash

Google

Gemini 3.5 Flash is Google's high-speed multimodal model with a 1M context window, optimized for sub-second agentic loops and complex coding tasks.

1M context
$1.50/$9.00/1M

Cau hoi thuong gap ve Gemini 3.8 Flash

Tim cau tra loi cho cac cau hoi thuong gap ve Gemini 3.8 Flash