google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite to wysokowydajny model od Google z 1M context window i throughput 350 tokens/sek dla agentic workflows.

WysokaWydajnośćDługiKontekstAgenticAIGoogleGemini
google logogoogleGemini21 lipca 2026
Kontekst
1.0Mtokenow
Maks. wyjscie
64Ktokenow
Cena wejscia
$0.30/ 1M
Cena wyjscia
$2.50/ 1M
Modalnosc:TextImageAudioVideo
Mozliwosci:WizjaNarzedziaStreaming
Benchmarki
GPQA
39%
GPQA: Pytania naukowe poziomu doktoranckiego. Rygorystyczny benchmark z 448 pytaniami z biologii, fizyki i chemii. Eksperci PhD osiagaja tylko 65-74% dokładnosci. Gemini 3.6 Flash Lite uzyskal 39% w tym benchmarku.
HLE
18%
HLE: Rozumowanie eksperckie wysokiego poziomu. Testuje zdolnosc modelu do demonstrowania rozumowania na poziomie eksperta w specjalistycznych dziedzinach. Gemini 3.6 Flash Lite uzyskal 18% w tym benchmarku.
MMLU
84%
MMLU: Masowe wielozadaniowe rozumienie jezyka. Kompleksowy benchmark z 16 000 pytan z 57 przedmiotow akademickich. Gemini 3.6 Flash Lite uzyskal 84% w tym benchmarku.
IFEval
89%
IFEval: Ocena przestrzegania instrukcji. Mierzy jak dobrze model przestrzega konkretnych instrukcji i ograniczen. Gemini 3.6 Flash Lite uzyskal 89% w tym benchmarku.
MATH
73%
MATH: Rozwiazywanie problemow matematycznych. Kompleksowy benchmark matematyczny testujacy rozwiazywanie problemow z algebry, geometrii, analizy. Gemini 3.6 Flash Lite uzyskal 73% w tym benchmarku.
GSM8k
94%
GSM8k: Matematyka szkoly podstawowej 8K. 8 500 zadan matematycznych poziomu szkoly podstawowej. Gemini 3.6 Flash Lite uzyskal 94% w tym benchmarku.
SWE-Bench
54%
SWE-Bench: Benchmark inzynierii oprogramowania. Modele AI probuja rozwiazac prawdziwe problemy GitHub w projektach Python. Gemini 3.6 Flash Lite uzyskal 54% w tym benchmarku.
HumanEval
85%
HumanEval: Zadania programistyczne Python. 164 zadania programistyczne, gdzie modele musza generowac poprawne implementacje funkcji Python. Gemini 3.6 Flash Lite uzyskal 85% w tym benchmarku.
Terminal-Bench
54%
Terminal-Bench: Zadania terminal/CLI. Testuje zdolnosc wykonywania operacji wiersza polecen. Gemini 3.6 Flash Lite uzyskal 54% w tym benchmarku.

O Gemini 3.6 Flash Lite

Dowiedz sie o mozliwosciach Gemini 3.6 Flash Lite, funkcjach i jak moze pomoc Ci osiagnac lepsze wyniki.

Szybkie agentic workflows

Gemini 3.6 Flash Lite celuje w zadania o dużej skali i niskiej latency, gdzie throughput i koszt są głównymi ograniczeniami. Oficjalnie udokumentowany jako Gemini 3.5 Flash-Lite, działa jako zoptymalizowany partner dla potężniejszego modelu Gemini 3.6 Flash. Model ten osiąga czas odpowiedzi poniżej sekundy i utrzymuje stabilny throughput na poziomie 350 output tokens na sekundę. Został zaprojektowany specjalnie do zadań w tle, syntezy wyszukiwania w czasie rzeczywistym oraz przetwarzania danych na dużą skalę.

Ogromny kontekst i narzędzia

Pomimo oznaczenia „lite”, model zachowuje flagowe 1 milion tokenów context window. Pozwala to programistom przetwarzać całe bazy kodu lub ogromne archiwa dokumentów bez skomplikowanych potoków RAG. Zawiera natywne wsparcie dla Computer Use, umożliwiając zautomatyzowane interakcje z UI i narzędzia do nawigacji po sieci. Dane treningowe obejmują informacje do marca 2026 roku, zapewniając lepszą świadomość najnowszych wersji oprogramowania niż wcześniejsze iteracje.

Skalowalność i integracja

Google zbudowało tę architekturę z myślą o subsekundowej wydajności w pętlach agentowych. Jest około 80% tańszy od standardowego modelu Flash, co czyni go opłacalnym dla projektów wymagających milionów interakcji miesięcznie. Integruje się ze standardowym API Gemini i obsługuje multimodalne dane wejściowe, w tym tekst, obrazy, audio i wideo.

Gemini 3.6 Flash Lite

Przypadki uzycia dla Gemini 3.6 Flash Lite

Odkryj rozne sposoby wykorzystania Gemini 3.6 Flash Lite do osiagniecia swietnych wynikow.

Wielkoskalowy audyt dokumentów

Przetwarzaj tysiące stron dokumentów firmowych jednocześnie, aby wyodrębnić ustrukturyzowane dane przy użyciu 1M context window.

Agentic Search & Retrieval

Zasilaj agentów wyszukujących w czasie rzeczywistym, którzy w kilka sekund syntezują informacje z dziesiątek źródeł internetowych dzięki wysokiemu throughput.

Utrzymanie persony chatbota

Utrzymuj spójne cechy charakteru i historię konwersacji przez miliony tokens na potrzeby wciągających gier RPG.

Automatyzacja Computer Use

Automatyzuj powtarzalne zadania UI, takie jak wprowadzanie danych i nawigacja po aplikacjach, używając natywnego narzędzia Computer Use.

Tagowanie danych na dużą skalę

Kategoryzuj miliony treści generowanych przez użytkowników lub zgłoszeń wsparcia przy ekstremalnie niskiej latency.

Lekkie generowanie kodu

Generuj gotowe do produkcji komponenty React lub zapytania SQL dla szybkiego programowania aplikacji.

Mocne strony

Ograniczenia

Wiodący w branży throughput: Model dostarcza 350 output tokens na sekundę, co czyni go najszybszym modelem w klasie Gemini 3.x.
Głębia reasoning: Zmaga się ze złożoną logiką i wieloetapowym reasoning w porównaniu do większych modeli Pro lub standardowych Flash.
Ekstremalna efektywność kosztowa: Przy cenie $0,30 za milion input tokens jest około 80% tańszy niż standardowy model Gemini 3.6 Flash.
Bufor wyjściowy: Model jest ograniczony do 64 tys. output tokens, co ogranicza jego użycie do generowania niezwykle długich treści.
Ogromny kontekst 1M: Przetwarzanie pełnego kontekstu dużych zbiorów danych jest możliwe bez fragmentacji nieodłącznie związanej z tradycyjnymi systemami RAG.
Przestrzeganie instrukcji: Niektórzy użytkownicy zgłaszają sporadyczne regresje w zachowaniu złożonego formatowania w porównaniu do wcześniejszych wersji Pro.
Niedawny knowledge cutoff: Cutoff z marca 2026 r. zapewnia, że model jest świadomy najnowszych wydarzeń i trendów w tworzeniu oprogramowania.
Wizja przestrzenna: Choć jest to multimodal model, jest zauważalnie mniej precyzyjny w precyzyjnym wykrywaniu obiektów na obrazach niż model 3.6 Flash.

Szybki start API

google/gemini-3.5-flash-lite

Zobacz dokumentacje
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Wyodrębnij wszystkie kluczowe daty z tego transkryptu umowy.",
    system_instruction: "Zwróć tylko JSON."
  });
  console.log(interaction.outputText);
}

main();

Zainstaluj SDK i zacznij wykonywac wywolania API w kilka minut.

Co mowia ludzie o Gemini 3.6 Flash Lite

Zobacz, co spolecznosc mysli o Gemini 3.6 Flash Lite

3.6 Flash jest wyraźnie najszybszy w pętlach agentowych i analizach długoformatowych, podczas gdy Flash-Lite jest zaskakująco blisko w pracy z dokumentami.
singularity_user
reddit
Gemini 3.5 Flash-Lite jest szybki, tani i niestrudzony. Idealny do mało efektownej harówki przy przetwarzaniu wsadowym.
WORLD3_AI
twitter
benchmarki są już na artificialanalysis... kosztują $0.09/$0.18 na Open Router, w porównaniu do $1/$5
hn_reader_99
hackernews
Model Lite jest szybszy i znacznie tańszy, ale poniósł sromotną porażkę w zadaniach wymagających głębokiego myślenia.
AI Coding Daily
youtube
Prędkość tego modelu jest szalona w przypadku zadań w tle, w zasadzie subsekundowa latency dla większości interakcji UI.
DevFlowX
twitter
Obsługuje 1 milion tokens tak jak więksi bracia, ale za ułamek ceny.
United Top Tech
youtube

Filmy o Gemini 3.6 Flash Lite

Ogladaj samouczki, recenzje i dyskusje o Gemini 3.6 Flash Lite

Google właśnie wypuściło trzy modele... 3.5 Flash lite... cena jest ekstremalnie niska.

Jest zoptymalizowany pod kątem zadań w świecie rzeczywistym przy wyższej prędkości i niższym koszcie.

Wydajność w prostych promptach jest bardzo żwawa.

Flash-Lite wydaje się być złotym środkiem dla programistów z ograniczonym budżetem.

Obsługuje 1 milion tokens, podobnie jak jego więksi bracia.

Model Lite jest szybszy i znacznie tańszy... w tej samej cenie co Grok 4.5.

Zdobył 5 na 5 punktów w projekcie React, tworzenie komponentów to teraz standard.

Zauważyłem pewne halucynacje, gdy podałem mu bardzo złożoną logikę.

W przypadku prostych komponentów UI jest tak dobry jak model Pro.

Latency to największy atut dla programistów korzystających z asystentów w czasie rzeczywistym.

Ten model jest w zasadzie po prostu szybszy... to bardziej efektywny pod kątem tokenów model w porównaniu do poprzednich wersji.

Zużywa około 17% mniej output tokens, aby dostarczyć wyższą jakość pracy.

Flash-Lite to mały koń roboczy, który obsługuje zadania w tle.

Możliwości wizyjne są nieco niższe, ale akceptowalne dla OCR.

To ogromny krok naprzód dla automatyzacji na dużą skalę.

Wiecej niz tylko prompty

Przyspiesz swoj workflow z automatyzacja AI

Automatio laczy moc agentow AI, automatyzacji web i inteligentnych integracji, aby pomoc Ci osiagnac wiecej w krotszym czasie.

Agenci AI
Automatyzacja web
Inteligentne workflow

Porady Pro dla Gemini 3.6 Flash Lite

Wskazówki ekspertów, aby w pełni wykorzystać Gemini 3.6 Flash Lite.

Ustaw poziom myślenia (Thinking Level)

Pozostaw thinking_level na poziomie minimalnym dla prostej klasyfikacji, aby zmaksymalizować szybkość, ale zwiększ go w przypadku korzystania z narzędzi (tool-calling).

Pomiń parametry próbkowania

API 3.x ignoruje temperature i top_p, więc używaj jawnych instrukcji systemowych, aby kontrolować determinizm wyjścia.

Wykorzystaj kontekst 1M

Wprowadzaj całą odpowiednią bazę wiedzy bezpośrednio do promptu, aby uzyskać lepsze wyniki niż w przypadku rozproszonych systemów RAG.

Używaj instrukcji systemowych

Stosuj system_instruction zamiast prefilling, aby zapobiec wstępom w outputach JSON.

Opinie

Co mowia nasi uzytkownicy

Dolacz do tysiecy zadowolonych uzytkownikow, ktorzy przeksztalcili swoj workflow

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Powiazane AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Często Zadawane Pytania o Gemini 3.6 Flash Lite

Znajdź odpowiedzi na częste pytania o Gemini 3.6 Flash Lite