google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite là model hiệu suất cao từ Google với context window 1M token và throughput 350 tokens/giây cho các quy trình agentic.

HiệuSuấtCaoContextDàiAgenticAIGoogleGemini
google logogoogleGemini21 tháng 7, 2026
Ngu canh
1.0Mtoken
Dau ra toi da
64Ktoken
Gia dau vao
$0.30/ 1M
Gia dau ra
$2.50/ 1M
Phuong thuc:TextImageAudioVideo
Kha nang:Thi giacCong cuTruyen truc tiep
Diem chuan
GPQA
39%
GPQA: Cau hoi khoa hoc cap sau dai hoc. Benchmark nghiem ngat voi 448 cau hoi ve sinh hoc, vat ly va hoa hoc. Chuyen gia PhD chi dat 65-74% do chinh xac. Gemini 3.6 Flash Lite dat 39% trong benchmark nay.
HLE
18%
HLE: Suy luan cap chuyen gia. Kiem tra kha nang mo hinh the hien suy luan cap chuyen gia trong cac linh vuc chuyen mon. Gemini 3.6 Flash Lite dat 18% trong benchmark nay.
MMLU
84%
MMLU: Hieu ngon ngu da nhiem voc lon. Benchmark toan dien voi 16.000 cau hoi tren 57 mon hoc. Gemini 3.6 Flash Lite dat 84% trong benchmark nay.
IFEval
89%
IFEval: Danh gia tuan theo huong dan. Do luong mo hinh tuan theo huong dan va rang buoc cu the tot nhu the nao. Gemini 3.6 Flash Lite dat 89% trong benchmark nay.
MATH
73%
MATH: Giai quyet van de toan hoc. Benchmark toan hoc toan dien kiem tra giai quyet van de trong dai so, hinh hoc, giai tich. Gemini 3.6 Flash Lite dat 73% trong benchmark nay.
GSM8k
94%
GSM8k: Toan tieu hoc 8K. 8.500 bai toan dang van ban cap tieu hoc. Gemini 3.6 Flash Lite dat 94% trong benchmark nay.
SWE-Bench
54%
SWE-Bench: Benchmark ky thuat phan mem. Cac mo hinh AI co gang giai quyet van de GitHub thuc trong cac du an Python. Gemini 3.6 Flash Lite dat 54% trong benchmark nay.
HumanEval
85%
HumanEval: Bai tap lap trinh Python. 164 bai tap lap trinh yeu cau mo hinh tao ra cac trien khai ham Python dung. Gemini 3.6 Flash Lite dat 85% trong benchmark nay.
Terminal-Bench
54%
Terminal-Bench: Tac vu terminal/CLI. Kiem tra kha nang thuc hien cac thao tac dong lenh. Gemini 3.6 Flash Lite dat 54% trong benchmark nay.

Ve Gemini 3.6 Flash Lite

Tim hieu ve kha nang cua Gemini 3.6 Flash Lite, tinh nang va cach no co the giup ban dat ket qua tot hon.

Quy trình Agentic tốc độ cao

Gemini 3.6 Flash Lite hướng tới các tác vụ khối lượng lớn, độ latency thấp, nơi throughput và chi phí là những ràng buộc chính. Được ghi nhận chính thức là Gemini 3.5 Flash-Lite, nó hoạt động như đối tác tối ưu hóa cho Gemini 3.6 Flash mạnh mẽ hơn. Model này đạt thời gian phản hồi dưới một giây và duy trì 350 output tokens mỗi giây một cách ổn định. Nó được thiết kế đặc biệt cho các tác vụ chạy ngầm, tổng hợp tìm kiếm thời gian thực và xử lý dữ liệu quy mô lớn.

Context khổng lồ và công cụ mạnh mẽ

Bất chấp cái tên 'lite', model này vẫn giữ lại context window 1 triệu token đặc trưng. Điều này cho phép các lập trình viên xử lý toàn bộ codebase hoặc kho lưu trữ tài liệu khổng lồ mà không cần các đường ống RAG phức tạp. Nó bao gồm hỗ trợ native cho Computer Use, cho phép tương tác UI tự động và các công cụ điều hướng web. Dữ liệu huấn luyện bao gồm thông tin đến tháng 3 năm 2026, cung cấp nhận thức tốt hơn về các phiên bản phần mềm gần đây so với các phiên bản trước.

Khả năng mở rộng và Tích hợp

Google đã xây dựng kiến trúc này để đạt hiệu suất dưới một giây trong các vòng lặp agentic. Nó rẻ hơn khoảng 80% so với model Flash tiêu chuẩn, giúp các dự án đòi hỏi hàng triệu tương tác hàng tháng trở nên khả thi hơn về kinh tế. Nó tích hợp với Gemini API tiêu chuẩn và hỗ trợ các đầu vào multimodal bao gồm văn bản, hình ảnh, âm thanh và video.

Gemini 3.6 Flash Lite

Truong hop su dung cho Gemini 3.6 Flash Lite

Kham pha cac cach khac nhau ban co the su dung Gemini 3.6 Flash Lite de dat ket qua tuyet voi.

Kiểm toán tài liệu khối lượng lớn

Xử lý hàng nghìn trang hồ sơ doanh nghiệp cùng lúc để trích xuất dữ liệu có cấu trúc bằng cách sử dụng context window 1M.

Tìm kiếm & Truy xuất Agentic

Cung cấp sức mạnh cho các search agent thời gian thực, tổng hợp thông tin từ hàng chục nguồn web chỉ trong vài giây nhờ throughput cao.

Duy trì tính cách Chatbot

Duy trì các đặc điểm tính cách nhất quán và lịch sử trò chuyện qua hàng triệu tokens cho các trò chơi nhập vai (RPG) sống động.

Tự động hóa Computer Use

Tự động hóa các tác vụ UI lặp đi lặp lại như nhập dữ liệu và điều hướng ứng dụng bằng công cụ Computer Use native.

Gán nhãn dữ liệu quy mô lớn

Phân loại hàng triệu nội dung do người dùng tạo hoặc phiếu hỗ trợ (support tickets) với độ latency cực thấp.

Tạo mã nguồn nhẹ

Tạo các React component hoặc SQL query sẵn sàng cho sản xuất để phát triển ứng dụng nhanh chóng.

Diem manh

Han che

Throughput dẫn đầu ngành: Model đạt tốc độ 350 output tokens mỗi giây, khiến nó trở thành model nhanh nhất trong lớp Gemini 3.x.
Độ sâu Reasoning: Nó gặp khó khăn với logic phức tạp và khả năng reasoning đa bước so với các model Pro hoặc Flash tiêu chuẩn lớn hơn.
Hiệu quả chi phí cực cao: Với mức giá $0.30 cho mỗi triệu input tokens, nó rẻ hơn khoảng 80% so với model Gemini 3.6 Flash tiêu chuẩn.
Output Buffer: Model bị giới hạn ở 64k output tokens, điều này hạn chế việc sử dụng nó để tạo các nội dung cực dài.
Context khổng lồ 1M: Có thể xử lý toàn bộ context của các tập dữ liệu lớn mà không gặp tình trạng phân mảnh vốn có trong các hệ thống RAG truyền thống.
Tuân thủ hướng dẫn: Một số người dùng báo cáo rằng khả năng duy trì định dạng phức tạp đôi khi bị thoái lui so với các phiên bản Pro trước đó.
Thời điểm cắt kiến thức gần đây: Thời điểm cắt vào tháng 3 năm 2026 đảm bảo model nắm bắt được các sự kiện gần đây và xu hướng phát triển phần mềm mới nhất.
Spatial Vision: Mặc dù là multimodal, nhưng nó kém chính xác hơn rõ rệt trong việc phát hiện vật thể chi tiết trong hình ảnh so với model 3.6 Flash.

Bat dau nhanh API

google/gemini-3.5-flash-lite

Xem tai lieu
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Trích xuất tất cả các ngày quan trọng từ bản ghi hợp đồng này.",
    system_instruction: "Chỉ xuất JSON."
  });
  console.log(interaction.outputText);
}

main();

Cai dat SDK va bat dau thuc hien cac cuoc goi API trong vai phut.

Moi nguoi dang noi gi ve Gemini 3.6 Flash Lite

Xem cong dong nghi gi ve Gemini 3.6 Flash Lite

3.6 Flash rõ ràng nhanh nhất cho các vòng lặp agent và phân tích văn bản dài, trong khi Flash-Lite đạt kết quả bất ngờ với công việc tài liệu.
singularity_user
reddit
Gemini 3.5 Flash-Lite nhanh, rẻ và không biết mệt mỏi. Hoàn hảo cho công việc xử lý hàng loạt đầy vất vả.
WORLD3_AI
twitter
các benchmark đã có trên artificialanalysis... chi phí $0.09/$0.18 trên Open Router, so với $1/$5
hn_reader_99
hackernews
Model Lite nhanh hơn và rẻ hơn nhiều, nhưng nó đã thất bại thảm hại ở các tác vụ đòi hỏi model phải suy nghĩ sâu.
AI Coding Daily
youtube
Tốc độ trên model này thật điên rồ đối với các tác vụ chạy ngầm, về cơ bản là latency dưới một giây cho hầu hết các tương tác UI.
DevFlowX
twitter
Nó xử lý 1 triệu tokens giống như các phiên bản anh em lớn hơn nhưng chỉ với một phần chi phí.
United Top Tech
youtube

Video ve Gemini 3.6 Flash Lite

Xem huong dan, danh gia va thao luan ve Gemini 3.6 Flash Lite

Google vừa thực sự tung ra ba model cùng lúc... 3.5 Flash lite... giá cực kỳ thấp.

Nó được tối ưu hóa cho các tác vụ thực tế với tốc độ cao hơn và chi phí thấp hơn.

Hiệu suất trên các prompt cơ bản rất nhanh nhạy.

Flash-Lite có vẻ là lựa chọn tối ưu cho các lập trình viên có ngân sách hạn hẹp.

Nó xử lý 1 triệu tokens giống như các phiên bản anh em lớn hơn.

Model Lite nhanh hơn và rẻ hơn nhiều... cùng giá với Grok 4.5.

Nó đạt 5/5 điểm trong dự án React, việc tạo các component giờ đây là điều hiển nhiên.

Tôi nhận thấy một số hiện tượng ảo giác (hallucination) khi đưa cho nó logic rất phức tạp.

Đối với các UI component đơn giản, nó tốt ngang ngửa model Pro.

Độ latency là điểm bán hàng lớn nhất cho các trợ lý lập trình thời gian thực.

Model này về cơ bản chỉ nhanh hơn... nó là một model hiệu quả về token hơn so với các phiên bản trước.

Nó sử dụng ít hơn khoảng 17% output tokens để mang lại kết quả chất lượng cao hơn.

Flash-Lite là một chú ngựa thồ nhỏ vận hành các tác vụ chạy ngầm.

Khả năng vision hơi thấp hơn một chút nhưng có thể chấp nhận được cho OCR.

Đó là một bước tiến lớn cho tự động hóa quy mô lớn.

Hon ca prompt

Tang cuong quy trinh lam viec cua ban voi Tu dong hoa AI

Automatio ket hop suc manh cua cac AI agent, tu dong hoa web va tich hop thong minh de giup ban lam duoc nhieu hon trong thoi gian ngan hon.

AI Agent
Tu dong hoa web
Quy trinh thong minh

Meo chuyen nghiep cho Gemini 3.6 Flash Lite

Meo chuyen gia giup ban tan dung toi da Gemini 3.6 Flash Lite va dat ket qua tot hon.

Thiết lập Thinking Level

Để thinking_level ở mức tối thiểu cho các tác vụ phân loại đơn giản nhằm tối đa hóa tốc độ, nhưng hãy tăng nó lên khi sử dụng tool-calling.

Loại bỏ Sampling Params

API 3.x bỏ qua temperature và top_p, vì vậy hãy sử dụng các hướng dẫn hệ thống (system instructions) cụ thể để kiểm soát tính xác định của đầu ra.

Tận dụng 1M Context

Đưa toàn bộ cơ sở tri thức liên quan trực tiếp vào prompt để có kết quả tốt hơn so với các hệ thống RAG phân mảnh.

Sử dụng System Instructions

Sử dụng system_instruction thay vì điền trước lượt của model để ngăn chặn các đoạn giới thiệu thừa trong đầu ra JSON.

Danh gia

Nguoi dung cua chung toi noi gi

Tham gia cung hang nghin nguoi dung hai long da thay doi quy trinh lam viec cua ho

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Lien quan AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Cau hoi thuong gap ve Gemini 3.6 Flash Lite

Tim cau tra loi cho cac cau hoi thuong gap ve Gemini 3.6 Flash Lite