google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite je visokoučinkovit model iz Googlea koji nudi 1M context window i throughput od 350 tokens/sek za agentic radne procese.

VisokaUčinkovitostDugiKontekstAgenticAIGoogleGemini
google logogoogleGemini21. srpnja 2026.
Kontekst
1.0Mtokena
Maks. izlaz
64Ktokena
Ulazna cijena
$0.30/ 1M
Izlazna cijena
$2.50/ 1M
Modalitet:TextImageAudioVideo
Mogućnosti:VidAlatiStreaming
Benchmarks
GPQA
39%
GPQA: Znanstvena pitanja i odgovori na razini doktorata. Rigorozan benchmark s 448 pitanja višestrukog izbora iz biologije, fizike i kemije koje su kreirali stručnjaci. Doktori znanosti postižu samo 65-74% točnosti, dok nestručnjaci postižu samo 34% čak i s neograničenim pristupom internetu (otuda naziv 'otporan na Google'). Gemini 3.6 Flash Lite je postigao 39% na ovom benchmarku.
HLE
18%
HLE: Rasuđivanje visoke razine stručnosti. Testira sposobnost modela da demonstrira rasuđivanje na razini stručnjaka u specijaliziranim domenama. Procjenjuje duboko razumijevanje složenih tema koje zahtijevaju znanje na profesionalnoj razini. Gemini 3.6 Flash Lite je postigao 18% na ovom benchmarku.
MMLU
84%
MMLU: Masovno višezadaćno jezično razumijevanje. Sveobuhvatan benchmark s 16.000 pitanja višestrukog izbora iz 57 akademskih predmeta uključujući matematiku, filozofiju, pravo i medicinu. Testira široko znanje i sposobnosti rasuđivanja. Gemini 3.6 Flash Lite je postigao 84% na ovom benchmarku.
IFEval
89%
IFEval: Evaluacija praćenja uputa. Mjeri koliko dobro model slijedi specifične upute i ograničenja. Testira sposobnost pridržavanja pravila formatiranja, ograničenja duljine i drugih eksplicitnih zahtjeva. Gemini 3.6 Flash Lite je postigao 89% na ovom benchmarku.
MATH
73%
MATH: Rješavanje matematičkih problema. Sveobuhvatan matematički benchmark koji testira rješavanje problema iz algebre, geometrije, računa i drugih matematičkih domena. Zahtijeva rasuđivanje u više koraka i formalno matematičko znanje. Gemini 3.6 Flash Lite je postigao 73% na ovom benchmarku.
GSM8k
94%
GSM8k: Matematika osnovne škole 8K. 8.500 matematičkih zadataka osnovnoškolske razine koji zahtijevaju rasuđivanje u više koraka. Testira osnovnu aritmetiku i logičko razmišljanje kroz scenarije iz stvarnog života poput kupovine ili izračuna vremena. Gemini 3.6 Flash Lite je postigao 94% na ovom benchmarku.
SWE-Bench
54%
SWE-Bench: Benchmark softverskog inženjerstva. AI modeli pokušavaju riješiti stvarne GitHub probleme u Python projektima otvorenog koda s ljudskom verifikacijom. Testira praktične vještine softverskog inženjerstva na produkcijskim kodnim bazama. Najbolji modeli su napredovali s 4,4% u 2023. na preko 70% u 2024. Gemini 3.6 Flash Lite je postigao 54% na ovom benchmarku.
HumanEval
85%
HumanEval: Python programerski problemi. 164 ručno napisana programerska problema gdje modeli moraju generirati ispravne implementacije Python funkcija. Svako rješenje se verificira jediničnim testovima. Najbolji modeli sada postižu preko 90% točnosti. Gemini 3.6 Flash Lite je postigao 85% na ovom benchmarku.
Terminal-Bench
54%
Terminal-Bench: Terminal/CLI zadaci. Testira sposobnost izvođenja operacija naredbenog retka, pisanja shell skripti i navigacije u terminalskim okruženjima. Mjeri praktične vještine administracije sustava i razvojnih radnih tokova. Gemini 3.6 Flash Lite je postigao 54% na ovom benchmarku.

O modelu Gemini 3.6 Flash Lite

Saznajte o mogućnostima, značajkama i načinima korištenja modela Gemini 3.6 Flash Lite.

Agentic radni procesi velike brzine

Gemini 3.6 Flash Lite fokusiran je na zadatke velikog volumena i niske latencije, gdje su throughput i troškovi primarna ograničenja. Službeno dokumentiran kao Gemini 3.5 Flash-Lite, funkcionira kao optimizirani partner moćnijeg modela Gemini 3.6 Flash. Ovaj model postiže vrijeme odziva ispod jedne sekunde i održava stabilan throughput od 350 izlaznih tokens u sekundi. Posebno je dizajniran za pozadinske zadatke, sintezu pretraživanja u stvarnom vremenu i obradu podataka velikih razmjera.

Masivni kontekst i alati

Unatoč nazivu "lite", model zadržava flagship 1 milijun tokens context window. To programerima omogućuje obradu cijelih baza koda ili masivnih arhiva dokumenata bez kompleksnih RAG cjevovoda. Uključuje izvornu podršku za Computer Use, omogućujući automatizirane UI interakcije i alate za web navigaciju. Podaci za trening uključuju informacije do ožujka 2026. godine, pružajući bolju informiranost o najnovijim softverskim verzijama nego ranije iteracije.

Skalabilnost i integracija

Google je izgradio ovu arhitekturu za performanse ispod jedne sekunde u agentic petljama. Otprilike je 80 % jeftiniji od standardnog Flash modela, što ga čini isplativim za projekte koji zahtijevaju milijune interakcija mjesečno. Integrira se sa standardnim Gemini API-jem i podržava multimodalne unose, uključujući tekst, slike, audio i video.

Gemini 3.6 Flash Lite

Slučajevi korištenja za Gemini 3.6 Flash Lite

Otkrijte različite načine korištenja modela Gemini 3.6 Flash Lite za postizanje izvrsnih rezultata.

Revizija dokumenata velikog volumena

Istodobno obradite tisuće stranica korporativnih dokumenata kako biste izvukli strukturirane podatke koristeći 1M context window.

Agentic pretraživanje i dohvaćanje

Pokrenite agente za pretraživanje u stvarnom vremenu koji sintetiziraju informacije iz desetaka web izvora u sekundi zahvaljujući visokom throughputu.

Postojanost persone chatbota

Održavajte dosljedne karakterne osobine i povijest razgovora kroz milijune tokens za impresivne RPG igre.

Automatizacija računalnih zadataka

Automatizirajte repetitivne UI zadatke poput unosa podataka i navigacije aplikacijama pomoću izvornog alata Computer Use.

Označavanje podataka velikih razmjera

Kategorizirajte milijune dijelova sadržaja koje su generirali korisnici ili tiketa podrške uz iznimno nisku latenciju.

Lagana generacija koda

Generirajte React komponente spremne za produkciju ili SQL upite za brzi razvoj aplikacija.

Prednosti

Ograničenja

Vodeći throughput u industriji: Model isporučuje 350 izlaznih tokens u sekundi, što ga čini najbržim modelom u klasi Gemini 3.x.
Dubina rezoniranja: Teško se nosi s kompleksnom logikom i višestupanjskim rezoniranjem u usporedbi s većim Pro ili standardnim Flash modelima.
Iznimna isplativost: Uz cijenu od 0,30 USD po milijunu ulaznih tokens, otprilike je 80 % jeftiniji od standardnog modela Gemini 3.6 Flash.
Izlazni međuspremnik (buffer): Model je ograničen na 64k izlaznih tokens, što ograničava njegovu upotrebu za generiranje iznimno dugih sadržaja.
Masivni 1M kontekst: Obrada punog konteksta velikih skupova podataka moguća je bez fragmentacije svojstvene tradicionalnim RAG sustavima.
Pridržavanje instrukcija: Neki korisnici prijavljuju povremene regresije u održavanju složenog formatiranja u usporedbi s ranijim Pro verzijama.
Nedavni datum znanja (cutoff): Cutoff u ožujku 2026. osigurava da je model upoznat s nedavnim događajima i najnovijim trendovima u razvoju softvera.
Prostorni vid: Iako je multimodalan, primjetno je manje precizan u finoj detekciji objekata na slikama od modela 3.6 Flash.

API brzi početak

google/gemini-3.5-flash-lite

Pogledaj dokumentaciju
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Izvuci sve ključne datume iz ovog transkripta ugovora.",
    system_instruction: "Izlaz mora biti samo JSON."
  });
  console.log(interaction.outputText);
}

main();

Instalirajte SDK i počnite s API pozivima za nekoliko minuta.

Što ljudi kažu o modelu Gemini 3.6 Flash Lite

Pogledajte što zajednica misli o modelu Gemini 3.6 Flash Lite

3.6 Flash je očito najbrži za agent petlje i analizu dugog sadržaja, dok se Flash-Lite iznenađujuće približava kod rada s dokumentima.
singularity_user
reddit
Gemini 3.5 Flash-Lite je brz, jeftin i neumoran. Savršen za mukotrpnu obradu u serijama.
WORLD3_AI
twitter
benchmarks su na artificialanalysis... cijene su 0,09 USD/0,18 USD na Open Routeru, u usporedbi s 1 USD/5 USD
hn_reader_99
hackernews
Lite model je brži i puno jeftiniji, ali je potpuno zakazao na zadacima gdje model treba duboko razmišljati.
AI Coding Daily
youtube
Brzina je nevjerojatna za pozadinske zadatke, praktički sub-sekundna latencija za većinu UI interakcija.
DevFlowX
twitter
Podržava 1 milijun tokens baš kao i veći modeli, ali uz djelić cijene.
United Top Tech
youtube

Videozapisi o modelu Gemini 3.6 Flash Lite

Gledajte tutorijale, recenzije i diskusije o modelu Gemini 3.6 Flash Lite

Google je upravo lansirao tri modela... 3.5 Flash lite... cijena je izuzetno niska.

Optimiziran je za zadatke u stvarnom svijetu uz veću brzinu i niže troškove.

Performanse na osnovnim promptovima su vrlo brze.

Flash-Lite se čini kao idealno rješenje za programere s ograničenim budžetom.

Podržava 1 milijun tokens baš kao i veći modeli.

Lite model je brži i puno jeftiniji... ista cijena kao Grok 4.5.

Osvojio je 5 od 5 bodova na React projektu, stvaranje komponenti sada je rutina.

Primijetio sam neke halucinacije kada sam mu zadao vrlo složenu logiku.

Za jednostavne UI komponente, jednako je dobar kao Pro model.

Latencija je najveća prednost za pomoćnike u kodiranju u stvarnom vremenu.

Ovaj model je jednostavno brži... model je učinkovitiji po pitanju tokens u usporedbi s prethodnim verzijama.

Koristi oko 17 % manje izlaznih tokens za isporuku kvalitetnijeg rada.

Flash-Lite je mali radni konj koji pokreće pozadinske zadatke.

Vizualne sposobnosti su malo slabije, ali prihvatljive za OCR.

Ovo je velik korak naprijed za automatizaciju velikih razmjera.

Vise od samo promptova

Poboljšajte svoj radni tijek sa AI Automatizacijom

Automatio kombinira moc AI agenata, web automatizacije i pametnih integracija kako bi vam pomogao postici vise za manje vremena.

AI Agenti
Web Automatizacija
Pametni Tokovi

Pro Savjeti za Gemini 3.6 Flash Lite

Stručni savjeti za maksimalno iskorištavanje Gemini 3.6 Flash Lite.

Postavljanje razine razmišljanja (Thinking Level)

Ostavite thinking_level na minimalnoj vrijednosti za jednostavnu klasifikaciju kako biste povećali brzinu, ali ga povećajte za tool-calling.

Uklanjanje parametara uzorkovanja

3.x API ignorira temperature i top_p, stoga koristite eksplicitne sistemske instrukcije za kontrolu determinizma izlaza.

Iskorištavanje 1M konteksta

Unesite cijelu relevantnu bazu znanja izravno u prompt za bolje rezultate nego što ih pružaju fragmentirani RAG sustavi.

Korištenje sistemskih instrukcija

Koristite system_instruction umjesto prefill-a modela kako biste spriječili uvode u JSON izlazima.

Svjedočanstva

Sto Kazu Nasi Korisnici

Pridruzite se tisucama zadovoljnih korisnika koji su transformirali svoj radni tijek

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Povezani AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Često Postavljana Pitanja o Gemini 3.6 Flash Lite

Pronađite odgovore na česta pitanja o Gemini 3.6 Flash Lite