google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite je model visoke efikasnosti iz Google-a koji sadrži 1M token context window i throughput od 350 tokens/sek za agentic radne procese.

VisokaEfikasnostDugačakKontekstAgenticAIGoogleGemini
google logogoogleGemini21. jul 2026.
Контекст
1.0Mтокена
Макс. излаз
64Kтокена
Улазна цена
$0.30/ 1M
Излазна цена
$2.50/ 1M
Модалитет:TextImageAudioVideo
Могућности:ВидАлатиСтриминг
Бенчмаркови
GPQA
39%
GPQA: Научна питања на нивоу докторантуре. Ригорозан бенчмарк са 448 питања вишеструког избора из биологије, физике и хемије које су креирали стручњаци. Докторанти постижу само 65-74% тачности, док нестручњаци постижу само 34% чак и са неограниченим приступом интернету (отуда назив 'отпоран на Google'). Gemini 3.6 Flash Lite је постигао 39% на овом бенчмарку.
HLE
18%
HLE: Резоновање високог нивоа експертизе. Тестира способност модела да демонстрира резоновање на нивоу експерта у специјализованим доменима. Процењује дубоко разумевање сложених тема које захтевају знање на професионалном нивоу. Gemini 3.6 Flash Lite је постигао 18% на овом бенчмарку.
MMLU
84%
MMLU: Масовно вишезадатко језичко разумевање. Свеобухватан бенчмарк са 16.000 питања вишеструког избора из 57 академских предмета укључујући математику, филозофију, право и медицину. Тестира широко знање и способности резоновања. Gemini 3.6 Flash Lite је постигао 84% на овом бенчмарку.
IFEval
89%
IFEval: Евалуација праћења инструкција. Мери колико добро модел следи специфичне инструкције и ограничења. Тестира способност придржавања правила форматирања, ограничења дужине и других експлицитних захтева. Gemini 3.6 Flash Lite је постигао 89% на овом бенчмарку.
MATH
73%
MATH: Решавање математичких проблема. Свеобухватан математички бенчмарк који тестира решавање проблема из алгебре, геометрије, рачуна и других математичких домена. Захтева резоновање у више корака и формално математичко знање. Gemini 3.6 Flash Lite је постигао 73% на овом бенчмарку.
GSM8k
94%
GSM8k: Математика основне школе 8K. 8.500 математичких задатака нивоа основне школе који захтевају резоновање у више корака. Тестира основну аритметику и логичко размишљање кроз сценарије из стварног живота попут куповине или рачунања времена. Gemini 3.6 Flash Lite је постигао 94% на овом бенчмарку.
SWE-Bench
54%
SWE-Bench: Бенчмарк софтверског инжењеринга. АИ модели покушавају да реше стварне GitHub проблеме у Python пројектима отвореног кода са људском верификацијом. Тестира практичне вештине софтверског инжењеринга на продукцијским базама кода. Најбољи модели су напредовали са 4,4% у 2023. на преко 70% у 2024. Gemini 3.6 Flash Lite је постигао 54% на овом бенчмарку.
HumanEval
85%
HumanEval: Python програмерски проблеми. 164 ручно написана програмерска проблема где модели морају да генеришу исправне имплементације Python функција. Свако решење се верификује јединичним тестовима. Најбољи модели сада постижу преко 90% тачности. Gemini 3.6 Flash Lite је постигао 85% на овом бенчмарку.
Terminal-Bench
54%
Terminal-Bench: Terminal/CLI задаци. Тестира способност извођења операција командне линије, писања shell скрипти и навигације у терминалским окружењима. Мери практичне вештине администрације система и развојних токова рада. Gemini 3.6 Flash Lite је постигао 54% на овом бенчмарку.

О моделу Gemini 3.6 Flash Lite

Сазнајте о могућностима, функцијама и начинима коришћења модела Gemini 3.6 Flash Lite.

Agentic radni procesi velike brzine

Gemini 3.6 Flash Lite je usmeren na zadatke velikog obima sa niskom latency, gde su throughput i cena primarna ograničenja. Zvanično dokumentovan kao Gemini 3.5 Flash-Lite, funkcioniše kao optimizovan partner moćnijeg modela Gemini 3.6 Flash. Ovaj model postiže vreme odziva ispod jedne sekunde i održava konstantnih 350 output tokens u sekundi. Dizajniran je specifično za pozadinske zadatke, sintezu pretrage u realnom vremenu i obradu podataka velikih razmera.

Masivan kontekst i alati

Uprkos oznaci "lite", model zadržava vodeći 1 million token context window. Ovo omogućava programerima da obrađuju cele baze koda ili ogromne arhive dokumenata bez kompleksnih RAG cevovoda. Uključuje nativnu podršku za Computer Use, omogućavajući automatizovane UI interakcije i alate za web navigaciju. Podaci za obuku uključuju informacije do marta 2026. godine, pružajući bolju informisanost o novijim verzijama softvera nego ranije iteracije.

Skalabilnost i integracija

Google je izgradio ovu arhitekturu za sub-second performanse u agentic petljama. Otprilike je 80% jeftiniji od standardnog Flash modela, što ga čini isplativim za projekte koji zahtevaju milione interakcija mesečno. Integriše se sa standardnim Gemini API-jem i podržava multimodal ulaze uključujući tekst, slike, audio i video.

Gemini 3.6 Flash Lite

Случајеви употребе за Gemini 3.6 Flash Lite

Откријте различите начине коришћења модела Gemini 3.6 Flash Lite за постизање одличних резултата.

Revizija dokumenata velikog obima

Istovremeno obradite hiljade stranica korporativne dokumentacije kako biste izvukli strukturirane podatke koristeći 1M context window.

Agentic pretraga i pronalaženje

Pokrećite search agente u realnom vremenu koji sintetišu informacije iz desetina web izvora u sekundi zahvaljujući visokom throughput-u.

Održavanje persone chatbota

Zadržite dosledne karakterne osobine i istoriju razgovora kroz milione tokens za impresivne RPG sesije.

Automatizacija kompjuterskih zadataka

Automatizujte repetitivne UI zadatke kao što su unos podataka i navigacija kroz aplikacije koristeći nativni Computer Use alat.

Označavanje podataka velikih razmera

Kategorizujte milione sadržaja generisanih od strane korisnika ili tiketa za podršku uz izuzetno malu latency.

Generisanje jednostavnog koda

Generišite React komponente ili SQL upite spremne za produkciju za brzi razvoj aplikacija.

Предности

Ограничења

Vodeći throughput u industriji: Model isporučuje 350 output tokens po sekundi, što ga čini najbržim modelom u klasi Gemini 3.x.
Dubina reasoning-a: Ima poteškoća sa kompleksnom logikom i multi-step reasoning-om u poređenju sa većim Pro ili standardnim Flash modelima.
Ekstremna isplativost: Sa cenom od 0,30 $ po milionu input tokens, otprilike je 80% jeftiniji od standardnog Gemini 3.6 Flash modela.
Output bafer: Model je ograničen na 64k output tokens, što ograničava njegovu upotrebu za generisanje ekstremno dugačkih sadržaja.
Masivni 1M kontekst: Moguća je obrada punog konteksta velikih skupova podataka bez fragmentacije svojstvene tradicionalnim RAG sistemima.
Pridržavanje instrukcija: Neki korisnici prijavljuju povremene regresije u održavanju složenog formatiranja u poređenju sa ranijim Pro verzijama.
Nedavni presek znanja: Presek iz marta 2026. osigurava da je model upoznat sa nedavnim događajima i najnovijim trendovima u razvoju softvera.
Prostorni vid: Iako je multimodal, primetno je manje precizan u finom otkrivanju objekata na slikama nego model 3.6 Flash.

АПИ брзи старт

google/gemini-3.5-flash-lite

Погледај документацију
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Izvuci sve ključne datume iz ovog transkripta ugovora.",
    system_instruction: "Izbaci isključivo JSON."
  });
  console.log(interaction.outputText);
}

main();

Инсталирајте SDK и почните са АПИ позивима за неколико минута.

Шта људи кажу о моделу Gemini 3.6 Flash Lite

Погледајте шта заједница мисли о моделу Gemini 3.6 Flash Lite

3.6 Flash je očigledno najbrži za agent petlje i analizu dužih formi, dok mu se Flash-Lite iznenađujuće približava u radu sa dokumentima.
singularity_user
reddit
Gemini 3.5 Flash-Lite je brz, jeftin i neumoran. Savršen za onaj dosadan posao masovne obrade podataka.
WORLD3_AI
twitter
benchmarkovi su na artificialanalysis... košta 0,09 $/0,18 $ na Open Routeru, u poređenju sa 1 $/5 $
hn_reader_99
hackernews
Lite model je brži i mnogo jeftiniji, ali je katastrofalno podbacio u zadacima gde model treba duboko da razmišlja.
AI Coding Daily
youtube
Brzina je neverovatna za pozadinske zadatke, u suštini sub-second latency za većinu UI interakcija.
DevFlowX
twitter
Obrađuje milion tokens baš kao i veći modeli, ali za delić cene.
United Top Tech
youtube

Видео снимци о моделу Gemini 3.6 Flash Lite

Гледајте туторијале, рецензије и дискусије о моделу Gemini 3.6 Flash Lite

Google je upravo lansirao tri modela... 3.5 Flash lite... cena je izuzetno niska.

Optimizovan je za realne zadatke uz veću brzinu i nižu cenu.

Performanse na osnovnim promptovima su veoma brze.

Flash-Lite deluje kao idealna opcija za programere sa ograničenim budžetom.

Obrađuje milion tokens baš kao i veći modeli.

Lite model je brži i mnogo jeftiniji... ista cena kao Grok 4.5.

Postigao je 5 od 5 bodova na React projektu, kreiranje komponenti je sada rutina.

Primeti se poneka halucinacija kada mu dam veoma kompleksnu logiku.

Za jednostavne UI komponente, jednako je dobar kao Pro model.

Latency je najveći adut za asistente za kodiranje u realnom vremenu.

Ovaj model je u suštini samo brži... efikasniji je sa tokenima u odnosu na prethodne verzije.

Koristi oko 17% manje output tokens da bi pružio kvalitetniji rad.

Flash-Lite je mali radni konj koji pokreće pozadinske zadatke.

Vizuelne mogućnosti su nešto slabije, ali prihvatljive za OCR.

Ovo je veliki korak napred za automatizaciju velikih razmera.

Vise od samo promptova

Побољшајте свој радни ток са AI Automatizacijom

Automatio kombinuje moc AI agenata, web automatizacije i pametnih integracija kako bi vam pomogao da postignete vise za manje vremena.

АИ Агенти
Веб Аутоматизација
Паметни Токови

Pro Saveti za Gemini 3.6 Flash Lite

Stručni saveti za maksimalno iskorišćenje Gemini 3.6 Flash Lite.

Podešavanje nivoa razmišljanja (thinking_level)

Ostavite thinking_level na minimalnom nivou za jednostavnu klasifikaciju kako biste maksimalno povećali brzinu, ali ga povećajte za pozivanje alata (tool-calling).

Uklanjanje sampling parametara

3.x API ignoriše temperature i top_p, pa koristite eksplicitne sistemske instrukcije za kontrolu determinizma output-a.

Iskorišćavanje 1M konteksta

Ubacite kompletnu relevantnu bazu znanja direktno u prompt za bolje rezultate u poređenju sa fragmentisanim RAG sistemima.

Korišćenje sistemskih instrukcija

Koristite system_instruction umesto unapred popunjenog poteza modela da biste sprečili pojavu uvodnih napomena u JSON izlazima.

Сведочанства

Sta Kazu Nasi Korisnici

Pridruzite se hiljadama zadovoljnih korisnika koji su transformisali svoj radni tok

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Povezani AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Често Постављана Питања о Gemini 3.6 Flash Lite

Пронађите одговоре на честа питања о Gemini 3.6 Flash Lite