google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite — это высокоэффективная модель от Google с context window 1M tokens и пропускной способностью 350 tokens/сек для agentic рабочих...

Высокая эффективностьДлинный контекстAgentic AIGoogle Gemini
google logogoogleGemini21 июля 2026 г.
Контекст
1.0Mтокенов
Макс. вывод
64Kтокенов
Цена ввода
$0.30/ 1M
Цена вывода
$2.50/ 1M
Модальность:TextImageAudioVideo
Возможности:ЗрениеИнструментыПотоковая передача
Бенчмарки
GPQA
39%
GPQA: Научные вопросы уровня докторантуры. Строгий бенчмарк с 448 вопросами с множественным выбором по биологии, физике и химии, созданными экспертами в данных областях. Эксперты с PhD достигают лишь 65-74% точности, в то время как неспециалисты набирают только 34% даже при неограниченном доступе в интернет (отсюда название 'устойчивый к Google'). Gemini 3.6 Flash Lite набрал 39% в этом бенчмарке.
HLE
18%
HLE: Рассуждение высокого уровня экспертизы. Тестирует способность модели демонстрировать рассуждения экспертного уровня в специализированных областях. Оценивает глубокое понимание сложных тем, требующих знаний профессионального уровня. Gemini 3.6 Flash Lite набрал 18% в этом бенчмарке.
MMLU
84%
MMLU: Массовое многозадачное языковое понимание. Комплексный бенчмарк с 16 000 вопросами с множественным выбором по 57 академическим предметам, включая математику, философию, право и медицину. Тестирует широкие знания и способности к рассуждению. Gemini 3.6 Flash Lite набрал 84% в этом бенчмарке.
IFEval
89%
IFEval: Оценка следования инструкциям. Измеряет, насколько хорошо модель следует конкретным инструкциям и ограничениям. Тестирует способность соблюдать правила форматирования, ограничения длины и другие явные требования. Gemini 3.6 Flash Lite набрал 89% в этом бенчмарке.
MATH
73%
MATH: Решение математических задач. Комплексный математический бенчмарк, тестирующий решение задач по алгебре, геометрии, анализу и другим математическим областям. Требует многошагового рассуждения и формальных математических знаний. Gemini 3.6 Flash Lite набрал 73% в этом бенчмарке.
GSM8k
94%
GSM8k: Математика начальной школы 8K. 8 500 математических задач уровня начальной школы, требующих многошагового рассуждения. Тестирует базовую арифметику и логическое мышление через жизненные сценарии, такие как покупки или расчет времени. Gemini 3.6 Flash Lite набрал 94% в этом бенчмарке.
SWE-Bench
54%
SWE-Bench: Бенчмарк программной инженерии. ИИ-модели пытаются решить реальные проблемы GitHub в проектах Python с открытым исходным кодом с человеческой верификацией. Тестирует практические навыки программной инженерии на производственных кодовых базах. Лучшие модели улучшились с 4,4% в 2023 до более 70% в 2024. Gemini 3.6 Flash Lite набрал 54% в этом бенчмарке.
HumanEval
85%
HumanEval: Задачи программирования на Python. 164 вручную написанные задачи программирования, где модели должны генерировать правильные реализации функций Python. Каждое решение проверяется юнит-тестами. Лучшие модели теперь достигают более 90% точности. Gemini 3.6 Flash Lite набрал 85% в этом бенчмарке.
Terminal-Bench
54%
Terminal-Bench: Задачи Terminal/CLI. Тестирует способность выполнять операции командной строки, писать shell-скрипты и работать в терминальных средах. Измеряет практические навыки системного администрирования и рабочих процессов разработки. Gemini 3.6 Flash Lite набрал 54% в этом бенчмарке.

О модели Gemini 3.6 Flash Lite

Узнайте о возможностях, функциях и способах использования Gemini 3.6 Flash Lite.

Высокоскоростные agentic рабочие процессы

Gemini 3.6 Flash Lite ориентирована на высоконагруженные задачи с низкой latency, где пропускная способность и стоимость являются главными ограничениями. Официально документированная как Gemini 3.5 Flash-Lite, она функционирует как оптимизированный партнер более мощной модели Gemini 3.6 Flash. Эта модель достигает субсекундного времени отклика и поддерживает устойчивую скорость генерации 350 output tokens в секунду. Она специально разработана для фоновых задач, синтеза поисковых запросов в реальном времени и обработки данных в больших масштабах.

Массивный контекст и инструментарий

Несмотря на приставку «lite», модель сохраняет флагманское context window размером 1 миллион tokens. Это позволяет разработчикам обрабатывать целые кодовые базы или огромные архивы документов без использования сложных RAG-пайплайнов. Модель включает нативную поддержку Computer Use, обеспечивая автоматизированное взаимодействие с UI и инструменты веб-навигации. Обучающие данные включают информацию по март 2026 года, что обеспечивает лучшее понимание недавних версий ПО, чем в более ранних итерациях.

Масштабируемость и интеграция

Google создала эту архитектуру для обеспечения субсекундной производительности в agentic циклах. Она примерно на 80% дешевле стандартной модели Flash, что делает ее использование оправданным для проектов, требующих миллионов взаимодействий ежемесячно. Модель интегрируется со стандартным API Gemini и поддерживает мультимодальный ввод, включая текст, изображения, аудио и видео.

Gemini 3.6 Flash Lite

Варианты использования Gemini 3.6 Flash Lite

Откройте для себя различные способы использования Gemini 3.6 Flash Lite для достижения отличных результатов.

Аудит большого объема документов

Одновременная обработка тысяч страниц корпоративной документации для извлечения структурированных данных с помощью context window 1M.

Agentic поиск и извлечение данных

Поддержка агентов поиска в реальном времени, которые за секунды синтезируют информацию из десятков веб-источников благодаря высокой пропускной способности.

Поддержание личности чат-бота

Сохранение последовательных черт характера и истории общения на протяжении миллионов tokens для иммерсивных RPG.

Автоматизация компьютерных задач

Автоматизация повторяющихся задач в UI, таких как ввод данных и навигация по приложениям, с помощью встроенного инструмента Computer Use.

Масштабная маркировка данных

Категоризация миллионов единиц пользовательского контента или тикетов поддержки с крайне низкой latency.

Легковесная генерация кода

Генерация готовых к продакшену React-компонентов или SQL-запросов для быстрой разработки приложений.

Преимущества

Ограничения

Лучшая в отрасли пропускная способность: Модель выдает 350 output tokens в секунду, что делает ее самой быстрой в классе Gemini 3.x.
Глубина reasoning: Модель испытывает трудности со сложной логикой и многошаговым reasoning по сравнению с более крупными моделями Pro или стандартными Flash.
Экстремальная экономическая эффективность: При цене $0,30 за миллион входных tokens она примерно на 80% дешевле стандартной модели Gemini 3.6 Flash.
Буфер вывода: Модель ограничена 64k выходных tokens, что ограничивает ее использование для генерации очень длинных контентных материалов.
Массивный контекст 1M: Возможна обработка больших наборов данных в полном контексте без фрагментации, присущей традиционным RAG-системам.
Следование инструкциям: Некоторые пользователи сообщают о периодической деградации в соблюдении сложного форматирования по сравнению с предыдущими версиями Pro.
Актуальная дата отсечки знаний: Дата отсечки март 2026 года гарантирует, что модель осведомлена о недавних событиях и последних трендах в разработке ПО.
Пространственное зрение: Несмотря на мультимодальность, она заметно менее точна при детальном обнаружении объектов на изображениях, чем модель 3.6 Flash.

Быстрый старт API

google/gemini-3.5-flash-lite

Посмотреть документацию
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Извлеки все ключевые даты из транскрипта этого контракта.",
    system_instruction: "Выводи только JSON."
  });
  console.log(interaction.outputText);
}

main();

Установите SDK и начните делать API-запросы за несколько минут.

Что люди говорят о Gemini 3.6 Flash Lite

Посмотрите, что думает сообщество о Gemini 3.6 Flash Lite

3.6 Flash явно быстрее всех для agent-циклов и анализа длинных текстов, в то время как Flash-Lite удивительно близка к ней в работе с документами.
singularity_user
reddit
Gemini 3.5 Flash-Lite, быстрая, дешевая и неутомимая. Идеально подходит для неблагодарной рутины пакетной обработки.
WORLD3_AI
twitter
бенчмарки есть на artificialanalysis... цена $0.09/$0.18 на Open Router по сравнению с $1/$5
hn_reader_99
hackernews
Lite-модель быстрее и намного дешевле, но она провалилась в задачах, где модели нужно глубоко мыслить.
AI Coding Daily
youtube
Скорость здесь безумная для фоновых задач, по сути субсекундная latency для большинства UI-взаимодействий.
DevFlowX
twitter
Она обрабатывает 1 миллион tokens точно так же, как и «старшие братья», но за долю стоимости.
United Top Tech
youtube

Видео о Gemini 3.6 Flash Lite

Смотрите обучающие материалы, обзоры и обсуждения о Gemini 3.6 Flash Lite

Google буквально только что выпустила три модели... 3.5 Flash lite... цена невероятно низкая.

Она оптимизирована для реальных задач с более высокой скоростью и низкой стоимостью.

Производительность на простых prompt'ах очень высокая.

Flash-Lite кажется золотой серединой для разработчиков с ограниченным бюджетом.

Она обрабатывает 1 миллион tokens точно так же, как и «старшие братья».

Lite-модель быстрее и намного дешевле... та же цена, что и у Grok 4.5.

Она набрала 5 из 5 баллов в React-проекте, создание компонентов теперь, базовая задача.

Я заметил некоторые галлюцинации, когда давал ей очень сложную логику.

Для простых UI-компонентов она так же хороша, как и модель Pro.

Latency, главный козырь для помощников в программировании реального времени.

Эта модель по сути просто быстрее... она более эффективно использует tokens по сравнению с предыдущими версиями.

Она использует примерно на 17% меньше выходных tokens для обеспечения более высокого качества работы.

Flash-Lite, это маленькая рабочая лошадка для фоновых задач.

Возможности зрения чуть слабее, но приемлемы для OCR.

Это огромный шаг вперед для масштабной автоматизации.

Больше чем просто промпты

Улучшите свой рабочий процесс с ИИ-Автоматизацией

Automatio объединяет мощь ИИ-агентов, веб-автоматизации и умных интеграций, чтобы помочь вам достигать большего за меньшее время.

ИИ Агенты
Веб Автоматизация
Умные Процессы

Советы для Gemini 3.6 Flash Lite

Экспертные советы для максимальной эффективности Gemini 3.6 Flash Lite.

Установка уровня мышления

Оставьте thinking_level на минимальном значении для простой классификации, чтобы максимизировать скорость, но повышайте его при использовании инструментов (tool-calling).

Удаление параметров сэмплирования

API версии 3.x игнорирует temperature и top_p, поэтому используйте явные системные инструкции для управления детерминизмом вывода.

Использование контекста 1M

Подавайте всю релевантную базу знаний непосредственно в prompt для получения лучших результатов, чем при использовании фрагментированных RAG-систем.

Использование системных инструкций

Используйте system_instruction вместо предварительного заполнения диалога модели, чтобы избежать вводных фраз в JSON-ответах.

Отзывы

Что Говорят Наши Пользователи

Присоединяйтесь к тысячам довольных пользователей, которые трансформировали свой рабочий процесс

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Похожие AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Часто задаваемые вопросы о Gemini 3.6 Flash Lite

Найдите ответы на частые вопросы о Gemini 3.6 Flash Lite