google

Gemini 3.8 Flash

Gemini 3.8 Flash är Googles multimodala AI med 1M context window, 64K output och agentic coding-kapacitet för $0,75 per miljon input-tokens.

MultimodalHög hastighetGoogle DeepMindLångt kontextfönsterAgentic Coding
google logogoogleGemini 32026-09-02
Kontext
1Mtokens
Max utdata
66Ktokens
Inmatningspris
$0.75/ 1M
Utdatapris
$3.75/ 1M
Modalitet:TextImageAudioVideo
Kapaciteter:VisionVerktygStreamingResonemang
Benchmarks
GPQA
59%
GPQA: Vetenskapliga fragor pa forskarutbildningsniva. Ett rigorost benchmark med 448 fragor fran biologi, fysik och kemi. PhD-experter uppnar endast 65-74% noggrannhet. Gemini 3.8 Flash fick 59% pa detta benchmark.
HLE
45.4%
HLE: Expertniva resonemang. Testar modellens formaga att demonstrera expertniva resonemang inom specialiserade omraden. Gemini 3.8 Flash fick 45.4% pa detta benchmark.
MMLU
88.2%
MMLU: Massiv multitask sprakforstaelse. Ett omfattande benchmark med 16 000 fragor over 57 akademiska amnen. Gemini 3.8 Flash fick 88.2% pa detta benchmark.
MMLU Pro
76.5%
MMLU Pro: MMLU Professionell utgava. En forbattrad version av MMLU med 12 032 fragor och ett svarare 10-alternativsformat. Gemini 3.8 Flash fick 76.5% pa detta benchmark.
SimpleQA
42%
SimpleQA: Benchmark for faktisk noggrannhet. Testar modellens formaga att ge korrekta, faktabaserade svar. Gemini 3.8 Flash fick 42% pa detta benchmark.
IFEval
87.5%
IFEval: Utvardering av instruktionsfoljandeformaga. Mater hur val en modell foljer specifika instruktioner och begransningar. Gemini 3.8 Flash fick 87.5% pa detta benchmark.
AIME 2025
82%
AIME 2025: American Invitational Mathematics Examination. Matematikproblem pa tavlingsniva fran det prestigefyllda AIME-provet. Gemini 3.8 Flash fick 82% pa detta benchmark.
MATH
78%
MATH: Matematisk problemlosning. Ett omfattande matematik-benchmark som testar problemlosning i algebra, geometri, kalkyl. Gemini 3.8 Flash fick 78% pa detta benchmark.
GSM8k
94%
GSM8k: Grundskola matematik 8K. 8 500 matematiska ordproblem pa grundskoleniva. Gemini 3.8 Flash fick 94% pa detta benchmark.
MGSM
91%
MGSM: Flersprakig grundskola matematik. GSM8k-benchmarket oversatt till 10 sprak. Gemini 3.8 Flash fick 91% pa detta benchmark.
MathVista
68%
MathVista: Matematiskt visuellt resonemang. Testar formagan att losa matematikproblem med visuella element. Gemini 3.8 Flash fick 68% pa detta benchmark.
SWE-Bench
49%
SWE-Bench: Benchmark for mjukvaruutveckling. AI-modeller forsoker losa verkliga GitHub-problem i Python-projekt. Gemini 3.8 Flash fick 49% pa detta benchmark.
HumanEval
85%
HumanEval: Python-programmeringsproblem. 164 programmeringsproblem dar modeller maste generera korrekta Python-funktionsimplementationer. Gemini 3.8 Flash fick 85% pa detta benchmark.
LiveCodeBench
65%
LiveCodeBench: Live-kodningsbenchmark. Testar kodningsformaga pa kontinuerligt uppdaterade, verkliga programmeringsutmaningar. Gemini 3.8 Flash fick 65% pa detta benchmark.
MMMU
69.5%
MMMU: Multimodal forstaelse. Multimodalt forstaelsebenchmark fran 30 universitetsanknutna amnen. Gemini 3.8 Flash fick 69.5% pa detta benchmark.
MMMU Pro
52%
MMMU Pro: MMMU Professionell utgava. Forbattrad version av MMMU med mer utmanande fragor. Gemini 3.8 Flash fick 52% pa detta benchmark.
ChartQA
86%
ChartQA: Diagram fragor och svar. Testar formagan att forsta och analysera information fran diagram och grafer. Gemini 3.8 Flash fick 86% pa detta benchmark.
DocVQA
93.5%
DocVQA: Visuella dokumentfragor. Testar formagan att extrahera information fran dokumentbilder. Gemini 3.8 Flash fick 93.5% pa detta benchmark.
Terminal-Bench
89.4%
Terminal-Bench: Terminal/CLI-uppgifter. Testar formagan att utfora kommandoradsoperationer. Gemini 3.8 Flash fick 89.4% pa detta benchmark.
ARC-AGI
4%
ARC-AGI: Abstraktion och resonemang. Testar flytande intelligens genom nya monsterigenkannigspussel. Gemini 3.8 Flash fick 4% pa detta benchmark.

Om Gemini 3.8 Flash

Lar dig om Gemini 3.8 Flashs kapacitet, funktioner och hur det kan hjalpa dig uppna battre resultat.

Modellöversikt

Gemini 3.8 Flash är Google DeepMinds högeffektiva multimodala modell som släpptes i september 2026. Systemet är byggt på Googles TPU-hårdvara och hanterar nativt text, ljud, högupplösta bilder och videoströmmar på upp till två timmar i ett enda context window på 1 048 576 tokens. Output-kapaciteten når 65 536 tokens per anrop. Modellen introducerar konfigurerbara resonemangsbudgetar över låga, medelhöga och höga parametrar, vilket gör det möjligt för ingenjörer att balansera latens mot token-konsumtion.

Agent-exekvering och arkitektur

Modellen är inriktad på långsiktiga kodningsuppgifter och terminalstyrning. Istället för att sluta efter en enda output-passning stöder Gemini 3.8 Flash rekursiva exekveringsloopar och autonoma verktygsinteraktioner. Träningen betonade containerhantering, kommandogränssnitt och cybersäkerhetsarbete. Denna träning ger lägre felprocent i testsviter och självkorrigering under live-byggen i miljöer som Google Antigravity.

Produktionsarbetsbelastningar och grundning

Utvecklare implementerar Gemini 3.8 Flash för latenskänsliga applikationer som kräver deterministisk verktygsanvändning. Nativa integrationer ansluter modellen direkt till Google Search-grundning och Google Maps-data utan separata hämtningspipelines. Även om frontier-modeller behåller fördelar på öppna kreativa uppgifter levererar 3.8 Flash jämförbara poäng i kodningsutvärderingar till ett lägre inferenspris.

Gemini 3.8 Flash

Anvandningsfall for Gemini 3.8 Flash

Upptack de olika satten du kan anvanda Gemini 3.8 Flash for att uppna fantastiska resultat.

Autonom terminalunderhåll

Utför refaktoriseringar av flera filer, kör testsviter i container-miljöer och patchar körtidsfel autonomt.

Högvolyms-videointag

Analyserar råa tvåtimmars videoinspelningar och ljudströmmar direkt inom sitt 1M token-fönster utan externa förbehandlingspipelines.

Extrahering av finansiella rapporter

Läser in långa finansiella handlingar och komplexa visuella PDF-filer för att beräkna balansräkningsmått till validerad JSON.

Snabb UI-prototypframtagning

Producerar kompletta webbapplikationer, interaktiva SVG-instrumentpaneler och WebGL-simuleringar på under femton sekunder.

Validering av defensiv säkerhet

Skannar källkodsarkiv för att identifiera logiska sårbarheter, spåra taintade variabler och generera kandidatpatchar för regressioner.

Agentorkestrering med låg latency

Fungerar som snabb åtgärdsplanerare i hierarkiska multi-agent-uppsättningar och anropar externa verktyg grundade av Google Search.

Styrkor

Begransningar

Ekonomi för agentic coding: Uppnådde 73,7 % på DeepSWE v1.1 och 89,4 % på Terminal-Bench 2.1 till en introduktionskostnad av $0,75 per miljon input-tokens.
Hög token-konsumtion vid djupt tänkande: Höga resonemangskonfigurationer utför utökade interna loopar som ökar token-outputen med upp till 30 % jämfört med 3.7 Flash.
Nativ långkontext-multimodalitet: Bearbetar upp till 1 048 576 tokens av kombinerat ljud, video och text utan externa pipelines för bildextrahering.
Lägre noggrannhet på komplexa terminal-benchmarks: Får 19,1 % på Terminal-Bench 4.0, vilket släpar efter större frontier-modeller som Claude Opus 5 på komplexa container-uppgifter.
Konfigurerbara resonemangsbudgetar: Erbjuder låga, medelhöga och höga tänkandenivåer så att utvecklare kan reglera token-latency och djup efter behov.
Marginalvinst i provresonemang: Allmän vetenskaplig slutledningsförmåga visade försumbar förändring med 45,4 % på Humanity's Last Exam jämfört med 45,7 % på 3.7 Flash.
Grundad verktygsintegration: Ansluter nativt till Google Search- och Google Maps-API:er för att ge verifierbara faktasvar med låga hallucinationsfrekvenser.
Schemalagd prishöjning: Introduktionspriset löper ut den 31 december 2026, vilket fördubblar kostnaderna till $1,50 för input och $7,50 för output per miljon tokens.

API snabbstart

google/gemini-3.8-flash

Visa dokumentation
google SDK
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({ apiKey: process.env.GEMINI_API_KEY });

async function main() {
  const response = await ai.models.generateContent({
    model: "gemini-3.8-flash",
    contents: "Analyze this code repository structure for memory leaks.",
    config: {
      maxOutputTokens: 8192,
      thinkingConfig: { thinkingBudget: 2048 }
    }
  });
  console.log(response.text);
}

main();

Installera SDK och borja gora API-anrop pa nagra minuter.

Vad folk sager om Gemini 3.8 Flash

Se vad communityt tycker om Gemini 3.8 Flash

Gemini 3.8 Flash är ännu ett hopp i agent-förmågor... vår tredje uppdaterade Flash-modell på bara 6 veckor.
Logan Kilpatrick
twitter
Hastigheten i kombination med det faktum att den här saken är riktigt bra på geografi och geospatiala färdigheter gör den enastående.
MapDev
hackernews
Gemini 3.8 Flash ligger i topp på Redactle LLM-benchmarken... den gör dessutom utvärderingarna billigare och snabbare än nästan alla andra modeller.
PuzzleSolver
reddit
Jag använder antigravity som primärt verktyg för arbete. Det senaste året har vi gått från att det tar minuter till att spotta ur sig nästan perfekt arbete på 10 sekunder.
SaaSBuilder
hackernews
Gemini Flash 3.8 slår Opus 5 till 15x lägre pris på fyra fristående three.js-fysikuppgifter.
GraphicsCoder
twitter
Att kontextfönstret på 1M hanterar video direkt utan att först konvertera till bilder sparar massor av ingenjörsarbete.
VideoAIPro
reddit

Videor om Gemini 3.8 Flash

Se handledningar, recensioner och diskussioner om Gemini 3.8 Flash

Deep SUI V1.1 Gemini 3.8 Flash kommer in på 73,7 %... i praktiken i paritet med Claude Opus 5 som precis släppts

Sedan har vi terminal bench 2.1. Den fick förstaplatsen på 89,4. Det här är agentic terminal coding

bra. Så, Claude Opus 5 dominerar konkurrensen totalt, med 1824, på andra plats 1710 för GPT 5.6 Soul, och sedan en ganska mycket sämre poäng på 1545 för Gemini 3.8 Flash. Så

Enligt artificell intelligens-index ligger den i princip vid Pareto-frontiern för kostnad kontra prestanda

Jämfört med föregående Gemini flash-modell slukade denna betydligt fler tokens för en given uppgift... upp till 30 % ökning

För token-generering kan du förvänta dig upp till 300 tokens per sekund enligt Artificial Intelligence Index.

Det är verkligen imponerande att man till det här priset får intelligens på Opus 5-nivå

Geminis stora problem är löst, det vill säga att den inte lägger till för mycket skräpinnehåll på webbplatsen

Och hörni, missförstå mig inte, det här är en imponerande modell eftersom vi varannan vecka ser nya modeller från Gemini som 3.6, 3.7 Flash och nu 3.8 Flash.

Mer an bara promptar

Superladda ditt arbetsflode med AI-automatisering

Automatio kombinerar kraften av AI-agenter, webbautomatisering och smarta integrationer for att hjalpa dig astadkomma mer pa kortare tid.

AI-agenter
Webbautomatisering
Smarta arbetsfloden

Proffs-tips for Gemini 3.8 Flash

Experttips for att hjalpa dig fa ut det mesta av Gemini 3.8 Flash och uppna battre resultat.

Välj tänkandenivåer explicit

Konfigurera tänkandeansträngningen till låg för strukturerade datatransformeringar eller hög för terminalfelsökning för att kontrollera token-användningen.

Aktivera context caching

Aktivera Gemini API context caching för promts över 32 000 tokens för att minska input-kostnaderna med upp till 75 procent.

Jorda frågor med nativa verktyg

Deklarera Google Search- och Maps-verktyg direkt i begäran för att hämta verifierade fakta från den verkliga världen och aktuell data.

Tillhandahåll direkt kompilatorfeedback

Skicka kompilator- och testkörningsutdata direkt tillbaka till modellen så att den kan åtgärda syntax- och logikfel i loopar.

Omdomen

Vad vara anvandare sager

Ga med tusentals nojda anvandare som har transformerat sitt arbetsflode

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relaterat AI Models

deepseek

DeepSeek-V3.2-Speciale

DeepSeek

DeepSeek-V3.2-Speciale is a reasoning-first LLM featuring gold-medal math performance, DeepSeek Sparse Attention, and a 131K context window. Rivaling GPT-5...

131K context
$0.28/$0.42/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
deepseek

DeepSeek-V4-Flash

DeepSeek

DeepSeek-V4-Flash is an open-weight 1M context AI model scoring 54.4% on SWE-bench at $0.14 per 1M tokens, optimized for agentic coding and reasoning.

1M context
$0.14/$0.28/1M
moonshot

Kimi K2.7 Code

Moonshot

Kimi K2.7 Code is a 1T parameter MoE model from Moonshot AI. It features a 262k context window and 30% more efficient reasoning for software engineering.

262K context
$0.95/$4.00/1M
anthropic

Claude 3.7 Sonnet

Anthropic

Claude 3.7 Sonnet is Anthropic's first hybrid reasoning model, delivering state-of-the-art coding capabilities, a 200k context window, and visible thinking.

200K context
$3.00/$15.00/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
google

Gemini 3.5 Flash

Google

Gemini 3.5 Flash is Google's high-speed multimodal model with a 1M context window, optimized for sub-second agentic loops and complex coding tasks.

1M context
$1.50/$9.00/1M

Vanliga fragor om Gemini 3.8 Flash

Hitta svar pa vanliga fragor om Gemini 3.8 Flash