google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite adalah model efisiensi tinggi dari Google yang menampilkan context window 1M token dan throughput 350 token/detik untuk alur kerja...

EfisiensiTinggiKonteksPanjangAgenticAIGoogleGemini
google logogoogleGemini21 Juli 2026
Konteks
1.0Mtoken
Output maks.
64Ktoken
Harga input
$0.30/ 1M
Harga output
$2.50/ 1M
Modalitas:TextImageAudioVideo
Kemampuan:VisiAlatStreaming
Benchmarks
GPQA
39%
GPQA: Tanya Jawab Sains Tingkat Doktoral. Benchmark ketat dengan 448 pertanyaan pilihan ganda dalam biologi, fisika, dan kimia yang dibuat oleh pakar domain. Para ahli PhD hanya mencapai akurasi 65-74%, sementara non-ahli hanya mendapat 34% bahkan dengan akses web tak terbatas (sehingga disebut 'tahan Google'). Gemini 3.6 Flash Lite meraih skor 39% pada benchmark ini.
HLE
18%
HLE: Penalaran Keahlian Tingkat Tinggi. Menguji kemampuan model untuk mendemonstrasikan penalaran tingkat ahli di domain khusus. Mengevaluasi pemahaman mendalam tentang topik kompleks yang membutuhkan pengetahuan tingkat profesional. Gemini 3.6 Flash Lite meraih skor 18% pada benchmark ini.
MMLU
84%
MMLU: Pemahaman Bahasa Multitugas Masif. Benchmark komprehensif dengan 16.000 pertanyaan pilihan ganda meliputi 57 mata pelajaran akademik termasuk matematika, filsafat, hukum, dan kedokteran. Menguji pengetahuan luas dan kemampuan penalaran. Gemini 3.6 Flash Lite meraih skor 84% pada benchmark ini.
IFEval
89%
IFEval: Evaluasi Kepatuhan Instruksi. Mengukur seberapa baik model mengikuti instruksi dan batasan tertentu. Menguji kemampuan untuk mematuhi aturan format, batas panjang, dan persyaratan eksplisit lainnya. Gemini 3.6 Flash Lite meraih skor 89% pada benchmark ini.
MATH
73%
MATH: Pemecahan Masalah Matematika. Benchmark matematika komprehensif yang menguji pemecahan masalah dalam aljabar, geometri, kalkulus, dan domain matematika lainnya. Membutuhkan penalaran multi-langkah dan pengetahuan matematika formal. Gemini 3.6 Flash Lite meraih skor 73% pada benchmark ini.
GSM8k
94%
GSM8k: Matematika SD 8K. 8.500 soal cerita matematika tingkat SD yang membutuhkan penalaran multi-langkah. Menguji aritmatika dasar dan pemikiran logis melalui skenario dunia nyata seperti belanja atau perhitungan waktu. Gemini 3.6 Flash Lite meraih skor 94% pada benchmark ini.
SWE-Bench
54%
SWE-Bench: Benchmark Rekayasa Perangkat Lunak. Model AI mencoba menyelesaikan masalah GitHub nyata dalam proyek Python open-source dengan verifikasi manusia. Menguji keterampilan rekayasa perangkat lunak praktis pada codebase produksi. Model terbaik meningkat dari 4,4% di 2023 menjadi lebih dari 70% di 2024. Gemini 3.6 Flash Lite meraih skor 54% pada benchmark ini.
HumanEval
85%
HumanEval: Masalah Pemrograman Python. 164 masalah pemrograman yang ditulis tangan di mana model harus menghasilkan implementasi fungsi Python yang benar. Setiap solusi diverifikasi dengan unit test. Model terbaik sekarang mencapai akurasi lebih dari 90%. Gemini 3.6 Flash Lite meraih skor 85% pada benchmark ini.
Terminal-Bench
54%
Terminal-Bench: Tugas Terminal/CLI. Menguji kemampuan untuk melakukan operasi baris perintah, menulis skrip shell, dan menavigasi lingkungan terminal. Mengukur keterampilan administrasi sistem praktis dan alur kerja pengembangan. Gemini 3.6 Flash Lite meraih skor 54% pada benchmark ini.

Tentang Gemini 3.6 Flash Lite

Pelajari tentang kemampuan, fitur, dan cara menggunakan Gemini 3.6 Flash Lite.

Alur Kerja Agentic Kecepatan Tinggi

Gemini 3.6 Flash Lite menargetkan tugas volume tinggi dan latency rendah di mana throughput dan biaya adalah batasan utama. Secara resmi didokumentasikan sebagai Gemini 3.5 Flash-Lite, model ini berfungsi sebagai mitra yang dioptimalkan untuk Gemini 3.6 Flash yang lebih kuat. Model ini mencapai waktu respons sub-detik dan mempertahankan 350 output tokens per detik yang konsisten. Model ini dirancang khusus untuk tugas latar belakang, sintesis pencarian real-time, dan pemrosesan data skala besar.

Konteks Masif dan Tooling

Meskipun berlabel lite, model ini tetap mempertahankan context window 1 juta token sebagai flagship-nya. Hal ini memungkinkan developer memproses seluruh basis kode atau arsip dokumen masif tanpa pipeline RAG yang rumit. Model ini mencakup dukungan bawaan untuk Computer Use, yang memungkinkan interaksi UI otomatis dan tool navigasi web. Data pelatihan mencakup informasi hingga Maret 2026, memberikan kesadaran yang lebih baik tentang versi perangkat lunak terbaru dibandingkan iterasi sebelumnya.

Skalabilitas dan Integrasi

Google membangun arsitektur ini untuk performa sub-detik dalam loop agentic. Model ini sekitar 80% lebih murah daripada model Flash standar, menjadikannya layak untuk proyek yang membutuhkan jutaan interaksi bulanan. Model ini terintegrasi dengan API Gemini standar dan mendukung input multimodal termasuk teks, gambar, audio, dan video.

Gemini 3.6 Flash Lite

Kasus Penggunaan untuk Gemini 3.6 Flash Lite

Temukan berbagai cara menggunakan Gemini 3.6 Flash Lite untuk hasil yang luar biasa.

Audit Dokumen Volume Tinggi

Proses ribuan halaman dokumen perusahaan secara bersamaan untuk mengekstrak data terstruktur menggunakan context window 1M.

Pencarian & Pengambilan Agentic

Dukung agent pencarian real-time yang mensintesis informasi dari puluhan sumber web dalam hitungan detik berkat throughput yang tinggi.

Persistensi Persona Chatbot

Pertahankan ciri karakter dan riwayat percakapan yang konsisten selama jutaan token untuk pengalaman RPG yang imersif.

Otomatisasi Computer Use

Otomatiskan tugas UI yang berulang seperti entri data dan navigasi aplikasi menggunakan tool Computer Use bawaan.

Penandaan Data Skala Besar

Kategorikan jutaan konten buatan pengguna atau tiket dukungan dengan latency yang sangat rendah.

Pembuatan Kode Ringan

Hasilkan komponen React atau query SQL yang siap pakai untuk pengembangan aplikasi yang cepat.

Kelebihan

Keterbatasan

Throughput Terdepan di Industri: Model ini memberikan 350 output tokens per detik, menjadikannya model tercepat di kelas Gemini 3.x.
Kedalaman Reasoning: Model ini kesulitan dengan logika kompleks dan reasoning multi-langkah dibandingkan model Pro yang lebih besar atau Flash standar.
Efisiensi Biaya Ekstrem: Dengan $0,30 per juta input tokens, model ini sekitar 80% lebih murah daripada model Gemini 3.6 Flash standar.
Output Buffer: Model ini dibatasi hingga 64k output tokens, yang membatasi penggunaannya untuk menghasilkan konten yang sangat panjang.
Konteks Masif 1M: Pemrosesan konteks penuh dari dataset besar dimungkinkan tanpa fragmentasi yang melekat pada sistem RAG tradisional.
Kepatuhan Instruksi: Beberapa pengguna melaporkan penurunan sesekali dalam mempertahankan pemformatan kompleks jika dibandingkan dengan versi Pro sebelumnya.
Batas Pengetahuan Terkini: Batas pengetahuan Maret 2026 memastikan model mengetahui peristiwa terkini dan tren pengembangan perangkat lunak terbaru.
Visi Spasial: Meskipun multimodal, model ini sedikit kurang presisi dalam deteksi objek yang mendetail dalam gambar dibandingkan model 3.6 Flash.

Mulai Cepat API

google/gemini-3.5-flash-lite

Lihat Dokumentasi
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Ekstrak semua tanggal penting dari transkrip kontrak ini.",
    system_instruction: "Output hanya dalam format JSON."
  });
  console.log(interaction.outputText);
}

main();

Instal SDK dan mulai melakukan panggilan API dalam hitungan menit.

Apa Kata Orang Tentang Gemini 3.6 Flash Lite

Lihat apa yang dipikirkan komunitas tentang Gemini 3.6 Flash Lite

3.6 Flash jelas tercepat untuk loop agent dan analisis bentuk panjang, sementara Flash-Lite secara mengejutkan hampir menyamai untuk pekerjaan dokumen.
singularity_user
reddit
Gemini 3.5 Flash-Lite itu cepat, murah, dan tak kenal lelah. Sempurna untuk pekerjaan rutin pemrosesan batch yang membosankan.
WORLD3_AI
twitter
benchmark sudah naik di artificialanalysis... biayanya $0.09/$0.18 di Open Router, dibandingkan dengan $1/$5
hn_reader_99
hackernews
Model Lite lebih cepat dan jauh lebih murah, tetapi gagal total pada tugas-tugas di mana model harus berpikir mendalam.
AI Coding Daily
youtube
Kecepatannya gila untuk tugas latar belakang, pada dasarnya latency sub-detik untuk sebagian besar interaksi UI.
DevFlowX
twitter
Dapat menangani 1 juta token seperti model saudaranya yang lebih besar tetapi dengan sebagian kecil dari biayanya.
United Top Tech
youtube

Video Tentang Gemini 3.6 Flash Lite

Tonton tutorial, ulasan, dan diskusi tentang Gemini 3.6 Flash Lite

Google baru saja meluncurkan tiga model sekaligus... 3.5 Flash lite... harganya jauh lebih murah.

Dioptimalkan untuk tugas dunia nyata dengan kecepatan lebih tinggi dan biaya lebih rendah.

Performa pada prompt dasar sangat cepat dan responsif.

Flash-Lite tampaknya menjadi titik ideal bagi developer dengan anggaran terbatas.

Dapat menangani 1 juta token seperti model saudaranya yang lebih besar.

Model Lite lebih cepat dan jauh lebih murah... harga yang sama dengan Grok 4.5.

Mencetak skor 5 dari 5 pada proyek React, membuat komponen sekarang menjadi hal dasar.

Saya melihat beberapa halusinasi ketika memberikan logika yang sangat kompleks.

Untuk komponen UI sederhana, kinerjanya sebaik model Pro.

Latency adalah nilai jual terbesar untuk asisten coding real-time.

Model ini pada dasarnya hanya lebih cepat... model ini lebih efisien dalam penggunaan token dibandingkan versi sebelumnya.

Menggunakan sekitar 17% lebih sedikit output tokens untuk memberikan kualitas kerja yang lebih tinggi.

Flash-Lite adalah pekerja keras kecil yang mendukung tugas-tugas latar belakang.

Kemampuan visinya sedikit lebih rendah namun dapat diterima untuk OCR.

Ini adalah langkah maju yang besar untuk otomatisasi skala besar.

Lebih dari sekadar prompt

Tingkatkan alur kerja Anda dengan Otomatisasi AI

Automatio menggabungkan kekuatan agen AI, otomatisasi web, dan integrasi cerdas untuk membantu Anda mencapai lebih banyak dalam waktu lebih singkat.

Agen AI
Otomasi Web
Alur Kerja Cerdas

Tips Pro untuk Gemini 3.6 Flash Lite

Tips ahli untuk memaksimalkan Gemini 3.6 Flash Lite.

Atur Tingkat Berpikir (Thinking Level)

Biarkan thinking_level pada pengaturan minimal untuk klasifikasi sederhana guna memaksimalkan kecepatan, namun tingkatkan untuk tool-calling.

Hapus Parameter Sampling

API 3.x mengabaikan temperature dan top_p, jadi gunakan system instructions yang eksplisit untuk mengontrol determinisme output.

Manfaatkan Konteks 1M

Masukkan seluruh basis pengetahuan yang relevan langsung ke dalam prompt untuk hasil yang lebih baik daripada sistem RAG yang terfragmentasi.

Gunakan System Instructions

Gunakan system_instruction daripada mengisi awal giliran model untuk mencegah adanya pembukaan (preamble) pada output JSON.

Testimoni

Apa Kata Pengguna Kami

Bergabunglah dengan ribuan pengguna puas yang telah mengubah alur kerja mereka

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Terkait AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Pertanyaan yang Sering Diajukan tentang Gemini 3.6 Flash Lite

Temukan jawaban untuk pertanyaan umum tentang Gemini 3.6 Flash Lite