google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite er en højeffektiv model fra Google med et 1M token context window og 350 tokens/sek throughput til agentic workflows.

HøjEffektivitetLangContextAgenticAIGoogleGemini
google logogoogleGemini21. juli 2026
Kontekst
1.0Mtokens
Maks output
64Ktokens
Input-pris
$0.30/ 1M
Output-pris
$2.50/ 1M
Modalitet:TextImageAudioVideo
Funktioner:VisionVærktøjerStreaming
Benchmarks
GPQA
39%
GPQA: Spørgsmål og svar på kandidatniveau. En streng benchmark med 448 multiple choice-spørgsmål inden for biologi, fysik og kemi skabt af domæneeksperter. PhD-eksperter opnår kun 65-74% nøjagtighed, mens ikke-eksperter scorer kun 34% selv med ubegrænset webadgang (derfor 'Google-proof'). Gemini 3.6 Flash Lite scorede 39% på denne benchmark.
HLE
18%
HLE: Ekspertniveau-ræsonnering. Tester en models evne til at demonstrere ekspertniveau-ræsonnering på tværs af specialiserede domæner. Evaluerer dyb forståelse af komplekse emner, der kræver professionel viden. Gemini 3.6 Flash Lite scorede 18% på denne benchmark.
MMLU
84%
MMLU: Massiv flerfaglig sprogforståelse. En omfattende benchmark med 16.000 multiple choice-spørgsmål på tværs af 57 akademiske fag, herunder matematik, filosofi, jura og medicin. Tester bred viden og ræsonneringsevner. Gemini 3.6 Flash Lite scorede 84% på denne benchmark.
IFEval
89%
IFEval: Instruktionsfølgningsevaluering. Måler, hvor godt en model følger specifikke instruktioner og begrænsninger. Tester evnen til at overholde formateringsregler, længdegrænser og andre eksplicitte krav. Gemini 3.6 Flash Lite scorede 89% på denne benchmark.
MATH
73%
MATH: Matematisk problemløsning. En omfattende matematikbenchmark, der tester problemløsning inden for algebra, geometri, calculus og andre matematiske domæner. Kræver flertrinssværsonnering og formel matematisk viden. Gemini 3.6 Flash Lite scorede 73% på denne benchmark.
GSM8k
94%
GSM8k: Folkeskole matematik 8K. 8.500 folkeskole-niveau matematiske tekstopgaver, der kræver flertrinssræsonnering. Tester grundlæggende aritmetik og logisk tænkning gennem virkelige scenarier som shopping eller tidsberegninger. Gemini 3.6 Flash Lite scorede 94% på denne benchmark.
SWE-Bench
54%
SWE-Bench: Softwareingeniør-benchmark. AI-modeller forsøger at løse rigtige GitHub-issues i open source Python-projekter med menneskelig verifikation. Tester praktiske softwareingeniørfærdigheder på produktionskodebaser. Topmodeller gik fra 4,4% i 2023 til over 70% i 2024. Gemini 3.6 Flash Lite scorede 54% på denne benchmark.
HumanEval
85%
HumanEval: Python-programmeringsopgaver. 164 håndskrevne programmeringsopgaver, hvor modeller skal generere korrekte Python-funktionsimplementeringer. Hver løsning verificeres mod unit tests. Topmodeller opnår nu 90%+ nøjagtighed. Gemini 3.6 Flash Lite scorede 85% på denne benchmark.
Terminal-Bench
54%
Terminal-Bench: Terminal/CLI-opgaver. Tester evnen til at udføre kommandolinjeopgaver, skrive shell-scripts og navigere i terminalmiljøer. Måler praktiske systemadministrations- og udviklingsworkflow-færdigheder. Gemini 3.6 Flash Lite scorede 54% på denne benchmark.

Om Gemini 3.6 Flash Lite

Lær om Gemini 3.6 Flash Lites muligheder, funktioner og hvordan den kan hjælpe dig med at opnå bedre resultater.

Hurtige agentic workflows

Gemini 3.6 Flash Lite retter sig mod opgaver med høj volumen og lav latency, hvor throughput og omkostninger er de primære begrænsninger. Officielt dokumenteret som Gemini 3.5 Flash-Lite, fungerer den som den optimerede partner til den kraftfulde Gemini 3.6 Flash. Denne model opnår svartider på under et sekund og opretholder en vedvarende throughput på 350 output tokens pr. sekund. Den er designet specifikt til baggrundsopgaver, syntese af søgninger i realtid og databehandling i stor skala.

Massiv context og værktøjer

På trods af sin 'lite'-betegnelse bevarer modellen flagskibets 1 million token context window. Dette gør det muligt for udviklere at behandle hele kodebaser eller massive dokumentarkiver uden komplekse RAG-pipelines. Den inkluderer indbygget support for Computer Use, hvilket muliggør automatiserede UI-interaktioner og værktøjer til navigation på nettet. Træningsdataene indeholder information frem til marts 2026, hvilket giver bedre kendskab til nyere softwareversioner end tidligere versioner.

Skalérbarhed og integration

Google har bygget denne arkitektur til sub-sekund ydeevne i agentic loops. Den er cirka 80 % billigere end standard Flash-modellen, hvilket gør den rentabel til projekter, der kræver millioner af månedlige interaktioner. Den integreres med standard Gemini API'en og understøtter multimodale inputs inklusive tekst, billeder, lyd og video.

Gemini 3.6 Flash Lite

Anvendelser for Gemini 3.6 Flash Lite

Opdag de forskellige måder, du kan bruge Gemini 3.6 Flash Lite til at opnå gode resultater.

Dokumentaudit i stor skala

Behandl tusindvis af sider fra virksomhedsrapporter samtidigt for at udtrække struktureret data ved hjælp af 1M context window.

Agentic søgning og hentning

Driv realtids-søgeagenter, der syntetiserer information fra dusinvis af netkilder på få sekunder takket være høj throughput.

Vedvarende chatbot-persona

Oprethold konsistente karaktertræk og samtalhistorik over millioner af tokens til medrivende rollespil.

Automatisering af computerbrug

Automatisér repetitive UI-opgaver såsom dataindtastning og app-navigation ved hjælp af det indbyggede Computer Use-værktøj.

Datatagging i stor skala

Kategorisér millioner af stykker brugergenereret indhold eller support-tickets med ekstremt lav latency.

Letvægts kodegenerering

Generer produktionsklar React-komponenter eller SQL-forespørgsler til hurtig applikationsudvikling.

Styrker

Begrænsninger

Markedsførende throughput: Modellen leverer 350 output tokens pr. sekund, hvilket gør den til den hurtigste model i Gemini 3.x-klassen.
Dybde i reasoning: Den kæmper med kompleks logik og reasoning i flere trin sammenlignet med større Pro- eller standard Flash-modeller.
Ekstrem omkostningseffektivitet: Til 0,30 $ pr. million input tokens er den cirka 80 % billigere end standard Gemini 3.6 Flash-modellen.
Output-buffer: Modellen er begrænset til 64k output tokens, hvilket begrænser dens brug til generering af ekstremt lange indholdsstykker.
Massiv 1M context: Full-context behandling af store datasæt er muligt uden den fragmentering, der er forbundet med traditionelle RAG-systemer.
Overholdelse af instruktioner: Nogle brugere rapporterer lejlighedsvise regressioner i opretholdelsen af kompleks formatering sammenlignet med tidligere Pro-versioner.
Nylig viden-cutoff: En cutoff i marts 2026 sikrer, at modellen er bekendt med nylige begivenheder og de nyeste trends inden for softwareudvikling.
Spatial vision: Selvom den er multimodal, er den bemærkelsesværdigt mindre præcis til fintmasket detektering af objekter i billeder end 3.6 Flash-modellen.

API hurtig start

google/gemini-3.5-flash-lite

Se dokumentation
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Udtræk alle vigtige datoer fra denne kontraktudskrift.",
    system_instruction: "Output kun JSON."
  });
  console.log(interaction.outputText);
}

main();

Installér SDK'et og begynd at foretage API-kald på få minutter.

Hvad folk siger om Gemini 3.6 Flash Lite

Se hvad fællesskabet mener om Gemini 3.6 Flash Lite

3.6 Flash er klart hurtigst til agent-loops og langformet analyse, mens Flash-Lite kommer overraskende tæt på ved dokumentarbejde.
singularity_user
reddit
Gemini 3.5 Flash-Lite er hurtig, billig og utrættelig. Perfekt til det mindre glamourøse slid ved batch-behandling.
WORLD3_AI
twitter
benchmarks er oppe på artificialanalysis... koster 0,09 $/0,18 $ på Open Router, sammenlignet med 1 $/5 $
hn_reader_99
hackernews
Lite-modellen er hurtigere og meget billigere, men den fejlede totalt i opgaver, hvor modellen skal tænke dybt.
AI Coding Daily
youtube
Hastigheden på denne er sindssyg til baggrundsopgaver, stort set sub-sekund latency for de fleste UI-interaktioner.
DevFlowX
twitter
Den håndterer 1 million tokens ligesom de større søskende, men til en brøkdel af prisen.
United Top Tech
youtube

Videoer om Gemini 3.6 Flash Lite

Se vejledninger, anmeldelser og diskussioner om Gemini 3.6 Flash Lite

Google har bogstaveligt talt lanceret tre modeller lige nu... 3.5 Flash lite... prisen er ekstremt lav.

Den er optimeret til virkelige opgaver ved højere hastighed og lavere pris.

Ydeevnen på simple prompts er meget hurtig.

Flash-Lite ser ud til at være det perfekte match for udviklere med et stramt budget.

Den håndterer 1 million tokens ligesom de større søskende.

Lite-modellen er hurtigere og meget billigere... samme pris som Grok 4.5.

Den scorede 5 ud af 5 point på et React-projekt, det er nu en standard at skabe komponenter.

Jeg bemærkede nogle hallucinationer, da jeg gav den meget kompleks logik.

Til simple UI-komponenter er den lige så god som Pro-modellen.

Latency er det største salgsargument for kodningsassistenter i realtid.

Denne model er stort set bare hurtigere... det er en mere token-effektiv model sammenlignet med tidligere versioner.

Den bruger omkring 17 % færre output tokens for at levere arbejde af højere kvalitet.

Flash-Lite er den lille arbejdshest, der driver baggrundsopgaver.

Vision-kapaciteterne er en smule lavere, men acceptable til OCR.

Det er et kæmpe skridt fremad for automatisering i stor skala.

Mere end bare prompts

Supercharg din arbejdsgang med AI-automatisering

Automatio kombinerer kraften fra AI-agenter, webautomatisering og smarte integrationer for at hjælpe dig med at udrette mere på kortere tid.

AI-agenter
Webautomatisering
Smarte arbejdsgange

Pro-tips til Gemini 3.6 Flash Lite

Eksperttips til at hjælpe dig med at få mest muligt ud af Gemini 3.6 Flash Lite og opnå bedre resultater.

Indstil tænkeniveau

Lad thinking_level stå til minimal ved simpel klassificering for at maksimere hastigheden, men øg det ved brug af tool-calling.

Fjern sampling-parametre

3.x API'en ignorerer temperature og top_p, så brug eksplicitte system-instruktioner til at kontrollere output-determinisme.

Udnyt 1M context

Fød hele den relevante vidensbase direkte ind i prompten for at opnå bedre resultater end med fragmenterede RAG-systemer.

Brug system-instruktioner

Brug system_instruction frem for at præ-udfylde modellens tur for at undgå indledende tekst (preambles) i JSON-outputs.

Anmeldelser

Hvad vores brugere siger

Slut dig til tusindvis af tilfredse brugere, der har transformeret deres arbejdsgang

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relateret AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Ofte stillede spørgsmål om Gemini 3.6 Flash Lite

Find svar på almindelige spørgsmål om Gemini 3.6 Flash Lite