google

Gemini 3.6 Flash Lite

Gemini 3.6 Flash Lite es un modelo de alta eficiencia de Google con una context window de 1M de tokens y un throughput de 350 tokens/seg para flujos de trabajo...

AltaEficienciaContextoExtensoIAAgenticGoogleGemini
google logogoogleGemini21 de julio de 2026
Contexto
1.0Mtokens
Salida máx.
64Ktokens
Precio entrada
$0.30/ 1M
Precio salida
$2.50/ 1M
Modalidad:TextImageAudioVideo
Capacidades:VisiónHerramientasStreaming
Benchmarks
GPQA
39%
GPQA: Q&A Científico Nivel Posgrado. Un riguroso benchmark con 448 preguntas de opción múltiple en biología, física y química creadas por expertos. Los doctores solo logran 65-74% de precisión, mientras que los no expertos obtienen solo 34% incluso con acceso ilimitado a internet (por eso 'a prueba de Google'). Gemini 3.6 Flash Lite obtuvo 39% en este benchmark.
HLE
18%
HLE: Razonamiento de Alto Nivel de Experticia. Evalúa la capacidad de un modelo para demostrar razonamiento a nivel experto en dominios especializados. Evalúa la comprensión profunda de temas complejos que requieren conocimiento profesional. Gemini 3.6 Flash Lite obtuvo 18% en este benchmark.
MMLU
84%
MMLU: Comprensión Masiva Multitarea del Lenguaje. Un benchmark completo con 16,000 preguntas de opción múltiple en 57 materias académicas incluyendo matemáticas, filosofía, derecho y medicina. Evalúa conocimiento amplio y capacidades de razonamiento. Gemini 3.6 Flash Lite obtuvo 84% en este benchmark.
IFEval
89%
IFEval: Evaluación de Seguimiento de Instrucciones. Mide qué tan bien un modelo sigue instrucciones y restricciones específicas. Evalúa la capacidad de adherirse a reglas de formato, límites de longitud y otros requisitos explícitos. Gemini 3.6 Flash Lite obtuvo 89% en este benchmark.
MATH
73%
MATH: Resolución de Problemas Matemáticos. Un benchmark completo de matemáticas que evalúa la resolución de problemas en álgebra, geometría, cálculo y otros dominios matemáticos. Requiere razonamiento en múltiples pasos y conocimiento matemático formal. Gemini 3.6 Flash Lite obtuvo 73% en este benchmark.
GSM8k
94%
GSM8k: Matemáticas de Primaria 8K. 8,500 problemas de matemáticas de nivel primaria que requieren razonamiento en múltiples pasos. Evalúa aritmética básica y pensamiento lógico a través de escenarios cotidianos. Gemini 3.6 Flash Lite obtuvo 94% en este benchmark.
SWE-Bench
54%
SWE-Bench: Benchmark de Ingeniería de Software. Los modelos de IA intentan resolver issues reales de GitHub en proyectos Python de código abierto con verificación humana. Evalúa habilidades prácticas de ingeniería de software. Los mejores modelos pasaron de 4.4% (2023) a más del 70% (2024). Gemini 3.6 Flash Lite obtuvo 54% en este benchmark.
HumanEval
85%
HumanEval: Problemas de Programación Python. 164 problemas de programación escritos a mano donde los modelos deben generar implementaciones correctas de funciones Python. Cada solución se verifica con tests unitarios. Los mejores modelos ahora logran más del 90%. Gemini 3.6 Flash Lite obtuvo 85% en este benchmark.
Terminal-Bench
54%
Terminal-Bench: Tareas de Terminal/CLI. Evalúa la capacidad de realizar operaciones de línea de comandos, escribir scripts de shell y navegar en entornos de terminal. Mide habilidades prácticas de administración de sistemas y flujos de trabajo de desarrollo. Gemini 3.6 Flash Lite obtuvo 54% en este benchmark.

Acerca de Gemini 3.6 Flash Lite

Conoce las capacidades, características y formas de uso de Gemini 3.6 Flash Lite.

Flujos de trabajo agentic de alta velocidad

Gemini 3.6 Flash Lite se dirige a tareas de alto volumen y baja latencia donde el throughput y el costo son las principales limitaciones. Documentado oficialmente como Gemini 3.5 Flash-Lite, funciona como el socio optimizado del más potente Gemini 3.6 Flash. Este modelo logra tiempos de respuesta de sub-segundo y mantiene una velocidad sostenida de 350 tokens de salida por segundo. Está diseñado específicamente para tareas en segundo plano, síntesis de búsqueda en tiempo real y procesamiento de datos a gran escala.

Contexto masivo y herramientas

A pesar de su designación lite, el modelo conserva la context window de 1 millón de tokens. Esto permite a los desarrolladores procesar bases de código completas o archivos de documentos masivos sin complejas tuberías RAG. Incluye soporte nativo para Computer Use, lo que permite interacciones de interfaz de usuario automatizadas y herramientas de navegación web. Los datos de entrenamiento incluyen información hasta marzo de 2026, lo que proporciona una mejor conciencia de las versiones de software recientes que las iteraciones anteriores.

Escalabilidad e integración

Google construyó esta arquitectura para un rendimiento de sub-segundo en bucles agentic. Es aproximadamente un 80% más barato que el modelo Flash estándar, lo que lo hace viable para proyectos que requieren millones de interacciones mensuales. Se integra con la API estándar de Gemini y admite entradas multimodales, incluidos texto, imágenes, audio y video.

Gemini 3.6 Flash Lite

Casos de uso de Gemini 3.6 Flash Lite

Descubre las diferentes formas de usar Gemini 3.6 Flash Lite para lograr excelentes resultados.

Auditoría de documentos de gran volumen

Procese miles de páginas de archivos corporativos simultáneamente para extraer datos estructurados utilizando la context window de 1M.

Búsqueda y recuperación agentic

Potencie agentes de búsqueda en tiempo real que sintetizan información de docenas de fuentes web en segundos gracias a su alto throughput.

Persistencia de personalidad en chatbots

Mantenga rasgos de carácter e historial de conversación coherentes durante millones de tokens para RPGs inmersivos.

Automatización de Computer Use

Automatice tareas de interfaz de usuario repetitivas, como la entrada de datos y la navegación en aplicaciones, usando la herramienta nativa Computer Use.

Etiquetado de datos a gran escala

Categorice millones de piezas de contenido generado por usuarios o tickets de soporte con una latencia extremadamente baja.

Generación de código ligero

Genere componentes de React o consultas SQL listas para producción para un desarrollo rápido de aplicaciones.

Fortalezas

Limitaciones

Throughput líder en la industria: El modelo ofrece 350 tokens de salida por segundo, lo que lo convierte en el modelo más rápido de la clase Gemini 3.x.
Profundidad de reasoning: Tiene dificultades con la lógica compleja y el reasoning de varios pasos en comparación con modelos Pro más grandes o Flash estándar.
Eficiencia de costos extrema: A $0.30 por millón de tokens de entrada, es aproximadamente un 80% más barato que el modelo estándar Gemini 3.6 Flash.
Búfer de salida: El modelo está restringido a 64k tokens de salida, lo que limita su uso para generar piezas de contenido extremadamente largas.
Contexto masivo de 1M: Es posible el procesamiento de contexto completo de grandes conjuntos de datos sin la fragmentación inherente a los sistemas RAG tradicionales.
Adherencia a instrucciones: Algunos usuarios informan de regresiones ocasionales en el mantenimiento de formatos complejos en comparación con versiones Pro anteriores.
Knowledge cutoff reciente: Un cutoff de marzo de 2026 asegura que el modelo esté al tanto de eventos recientes y de las últimas tendencias en desarrollo de software.
Visión espacial: Aunque es multimodal, es notablemente menos preciso en la detección de objetos de grano fino en imágenes que el modelo 3.6 Flash.

Inicio rápido de API

google/gemini-3.5-flash-lite

Ver documentación
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.GEMINI_API_KEY
});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.5-flash-lite",
    input: "Extrae todas las fechas clave de esta transcripción de contrato.",
    system_instruction: "Salida solo en JSON."
  });
  console.log(interaction.outputText);
}

main();

Instala el SDK y comienza a hacer llamadas API en minutos.

Lo que la gente dice sobre Gemini 3.6 Flash Lite

Mira lo que la comunidad piensa sobre Gemini 3.6 Flash Lite

3.6 Flash es claramente el más rápido para bucles de agentes y análisis de formato largo, mientras que Flash-Lite se acerca sorprendentemente en el trabajo con documentos.
singularity_user
reddit
Gemini 3.5 Flash-Lite es rápido, barato e incansable. Perfecto para el trabajo poco glamuroso del procesamiento por lotes.
WORLD3_AI
twitter
los benchmarks están en artificialanalysis... cuesta $0.09/$0.18 en Open Router, comparado con $1/$5
hn_reader_99
hackernews
El modelo Lite es más rápido y mucho más barato, pero falló miserablemente en tareas donde el modelo necesita pensar profundamente.
AI Coding Daily
youtube
La velocidad en esto es una locura para tareas de segundo plano, básicamente latencia de sub-segundo para la mayoría de las interacciones de interfaz.
DevFlowX
twitter
Maneja 1 millón de tokens igual que sus hermanos mayores pero a una fracción del costo.
United Top Tech
youtube

Videos sobre Gemini 3.6 Flash Lite

Mira tutoriales, reseñas y discusiones sobre Gemini 3.6 Flash Lite

Google ha lanzado literalmente tres modelos en este momento... 3.5 Flash lite... el precio es extremadamente bajo.

Está optimizado para tareas del mundo real a mayor velocidad y menor costo.

El rendimiento en prompts básicos es muy ágil.

Flash-Lite parece ser el punto óptimo para desarrolladores con presupuesto limitado.

Maneja 1 millón de tokens igual que sus hermanos mayores.

El modelo Lite es más rápido y mucho más barato... mismo precio que Grok 4.5.

Obtuvo 5 de 5 puntos en un proyecto de React; crear componentes ahora es lo mínimo necesario.

Noté algunas alucinaciones cuando le di lógica muy compleja.

Para componentes de interfaz simples, es tan bueno como el modelo Pro.

La latencia es el mayor argumento de venta para asistentes de codificación en tiempo real.

Este modelo es básicamente solo más rápido... es un modelo más eficiente en tokens en comparación con versiones anteriores.

Usa alrededor de un 17% menos de tokens de salida para entregar trabajo de mayor calidad.

Flash-Lite es el pequeño caballo de batalla que impulsa las tareas en segundo plano.

Las capacidades de visión son ligeramente inferiores pero aceptables para OCR.

Es un gran paso adelante para la automatización a gran escala.

Mas que solo prompts

Potencia tu flujo de trabajo con Automatizacion IA

Automatio combina el poder de agentes de IA, automatizacion web e integraciones inteligentes para ayudarte a lograr mas en menos tiempo.

Agentes de IA
Automatización Web
Flujos Inteligentes

Consejos Pro para Gemini 3.6 Flash Lite

Consejos de expertos para ayudarte a sacar el máximo provecho de Gemini 3.6 Flash Lite.

Configurar el nivel de razonamiento

Deje thinking_level en minimal para una clasificación simple a fin de maximizar la velocidad, pero auméntelo para la llamada a herramientas (tool-calling).

Eliminar parámetros de muestreo

La API 3.x ignora temperature y top_p, así que use instrucciones de sistema explícitas para controlar el determinismo de la salida.

Aprovechar el contexto de 1M

Introduzca toda la base de conocimientos relevante directamente en el prompt para obtener mejores resultados que con sistemas RAG fragmentados.

Usar instrucciones de sistema

Utilice system_instruction en lugar de completar el turno del modelo para evitar preámbulos en las salidas JSON.

Testimonios

Lo Que Dicen Nuestros Usuarios

Unete a miles de usuarios satisfechos que han transformado su flujo de trabajo

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relacionados AI Models

openai

GPT-4o mini

OpenAI

OpenAI's most cost-efficient small model, GPT-4o mini offers multimodal intelligence and high-speed performance at a significantly lower price point.

128K context
$0.15/$0.60/1M
alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
moonshot

Kimi K3

Moonshot

Kimi K3 is Moonshot AI's 2.8T MoE model with a 1M token context window, native multimodal vision, and frontier-tier coding performance for complex agents.

1M context
$3.00/$15.00/1M
zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M

Preguntas Frecuentes Sobre Gemini 3.6 Flash Lite

Encuentra respuestas a preguntas comunes sobre Gemini 3.6 Flash Lite