openai

GPT-4o mini

OpenAI:s mest kostnadseffektiva small model, GPT-4o mini, erbjuder multimodal intelligens och hög prestanda till ett betydligt lägre pris.

Liten modellKostnadseffektivVision-kapabelSnabb AIMultimodal
openai logoopenaiGPT-4o18 juli 2024
Kontext
128Ktokens
Max utdata
16Ktokens
Inmatningspris
$0.15/ 1M
Utdatapris
$0.60/ 1M
Modalitet:TextImage
Kapaciteter:VisionVerktygStreaming
Benchmarks
GPQA
40.2%
GPQA: Vetenskapliga fragor pa forskarutbildningsniva. Ett rigorost benchmark med 448 fragor fran biologi, fysik och kemi. PhD-experter uppnar endast 65-74% noggrannhet. GPT-4o mini fick 40.2% pa detta benchmark.
HLE
2.3%
HLE: Expertniva resonemang. Testar modellens formaga att demonstrera expertniva resonemang inom specialiserade omraden. GPT-4o mini fick 2.3% pa detta benchmark.
MMLU
82%
MMLU: Massiv multitask sprakforstaelse. Ett omfattande benchmark med 16 000 fragor over 57 akademiska amnen. GPT-4o mini fick 82% pa detta benchmark.
MMLU Pro
57%
MMLU Pro: MMLU Professionell utgava. En forbattrad version av MMLU med 12 032 fragor och ett svarare 10-alternativsformat. GPT-4o mini fick 57% pa detta benchmark.
SimpleQA
8.6%
SimpleQA: Benchmark for faktisk noggrannhet. Testar modellens formaga att ge korrekta, faktabaserade svar. GPT-4o mini fick 8.6% pa detta benchmark.
IFEval
76.5%
IFEval: Utvardering av instruktionsfoljandeformaga. Mater hur val en modell foljer specifika instruktioner och begransningar. GPT-4o mini fick 76.5% pa detta benchmark.
AIME 2025
5%
AIME 2025: American Invitational Mathematics Examination. Matematikproblem pa tavlingsniva fran det prestigefyllda AIME-provet. GPT-4o mini fick 5% pa detta benchmark.
MATH
50.2%
MATH: Matematisk problemlosning. Ett omfattande matematik-benchmark som testar problemlosning i algebra, geometri, kalkyl. GPT-4o mini fick 50.2% pa detta benchmark.
GSM8k
91.3%
GSM8k: Grundskola matematik 8K. 8 500 matematiska ordproblem pa grundskoleniva. GPT-4o mini fick 91.3% pa detta benchmark.
MGSM
87%
MGSM: Flersprakig grundskola matematik. GSM8k-benchmarket oversatt till 10 sprak. GPT-4o mini fick 87% pa detta benchmark.
MathVista
42%
MathVista: Matematiskt visuellt resonemang. Testar formagan att losa matematikproblem med visuella element. GPT-4o mini fick 42% pa detta benchmark.
SWE-Bench
8.7%
SWE-Bench: Benchmark for mjukvaruutveckling. AI-modeller forsoker losa verkliga GitHub-problem i Python-projekt. GPT-4o mini fick 8.7% pa detta benchmark.
HumanEval
87.2%
HumanEval: Python-programmeringsproblem. 164 programmeringsproblem dar modeller maste generera korrekta Python-funktionsimplementationer. GPT-4o mini fick 87.2% pa detta benchmark.
LiveCodeBench
32.5%
LiveCodeBench: Live-kodningsbenchmark. Testar kodningsformaga pa kontinuerligt uppdaterade, verkliga programmeringsutmaningar. GPT-4o mini fick 32.5% pa detta benchmark.
MMMU
59.4%
MMMU: Multimodal forstaelse. Multimodalt forstaelsebenchmark fran 30 universitetsanknutna amnen. GPT-4o mini fick 59.4% pa detta benchmark.
MMMU Pro
34%
MMMU Pro: MMMU Professionell utgava. Forbattrad version av MMMU med mer utmanande fragor. GPT-4o mini fick 34% pa detta benchmark.
ChartQA
78%
ChartQA: Diagram fragor och svar. Testar formagan att forsta och analysera information fran diagram och grafer. GPT-4o mini fick 78% pa detta benchmark.
DocVQA
88%
DocVQA: Visuella dokumentfragor. Testar formagan att extrahera information fran dokumentbilder. GPT-4o mini fick 88% pa detta benchmark.
Terminal-Bench
40%
Terminal-Bench: Terminal/CLI-uppgifter. Testar formagan att utfora kommandoradsoperationer. GPT-4o mini fick 40% pa detta benchmark.
ARC-AGI
8%
ARC-AGI: Abstraktion och resonemang. Testar flytande intelligens genom nya monsterigenkannigspussel. GPT-4o mini fick 8% pa detta benchmark.

Om GPT-4o mini

Lar dig om GPT-4o minis kapacitet, funktioner och hur det kan hjalpa dig uppna battre resultat.

En ny standard för små modeller

GPT-4o mini representerar ett betydande steg inom AI-effektivitet, designad för att ersätta GPT-3.5 Turbo som den självklara modellen för utvecklare. Byggd med en inbyggd multimodal arkitektur levererar den GPT-4-klassad prestanda till en bråkdel av kostnaden och latensen. Den har ett massivt context window på 128 000 tokens och stöder komplexa output-svar på upp till 16 384 tokens, vilket gör den idealisk för bearbetning av långa dokument och dataströmmar med hög volym.

Intelligens möter prisvärdhet

Till skillnad från tidigare små modeller som offrade intelligens för hastighet, bibehåller GPT-4o mini hög förmåga för resonemang i både text- och vision-uppgifter. Den är 60 % billigare än GPT-3.5 Turbo och betydligt mer kapabel, med ett resultat på 82 % på MMLU-benchmark. Denna modell är specifikt optimerad för applikationer där låg latens och hög tillförlitlighet är avgörande, som kundtjänstassistenter i realtid och motorer för storskalig dataklassificering.

GPT-4o mini

Anvandningsfall for GPT-4o mini

Upptack de olika satten du kan anvanda GPT-4o mini for att uppna fantastiska resultat.

Automatisering av kundtjänst

Hantering av stora volymer kundförfrågningar med låg latens och hög precision till en bråkdel av kostnaden.

Sammanfattning av innehåll

Bearbetning av stora dokument eller längre innehåll till koncisa sammanfattningar inom context window på 128k.

Dataextrahering

Konvertering av ostrukturerad text eller bilder till strukturerade dataformat som JSON för databasinmatning.

Flerspråkig översättning

Tillhandahållande av översättning i realtid på dussintals språk för chattapplikationer och global kommunikation.

Pedagogisk handledning

Fungerar som en interaktiv studieassistent för studenter som behöver hjälp med matematik, naturvetenskap och språk.

Enklare vision-uppgifter

Analys av bilder för att identifiera objekt, extrahera text via OCR eller ge beskrivningar för tillgänglighet.

Styrkor

Begransningar

Otrolig prestanda per krona: Med $0.15 per miljon input tokens erbjuder den resonemang på frontier-nivå med ett MMLU-resultat på 82 %.
Luckor i komplext resonemang: Ligger efter större modeller som GPT-4o eller o1 inom avancerad vetenskap, med 40,2 % på GPQA.
Hög genomströmning (throughput): Modellen levererar svar med extremt låg latens, vilket gör den idealisk för användargränssnitt i realtid.
Begränsningar inom kodning: Saknar den djupa arkitektoniska förståelsen för komplex mjukvaruutveckling jämfört med Claude 3.5 Sonnet.
Stort context window: Bibehåller ett fullt context window på 128k, vilket möjliggör komplex dokumentbearbetning som sällan ses i små modeller.
Minskat output-fönster: Output-gränsen på 16k kan vara begränsande för uppgifter som kräver massiva kodmigreringar eller generering i boklängd.
Inbyggt vision-stöd: Inkluderar multimodala funktioner i ett litet format, med utmärkta resultat vid bildanalys och OCR-uppgifter.
Stabilitet i faktauppgifter: Mindre modeller förblir mer benägna att hallucinera inom nischade områden jämfört med deras flagship-motsvarigheter.

API snabbstart

openai/gpt-4o-mini

Visa dokumentation
openai SDK
import OpenAI from "openai";

const openai = new OpenAI();

async function main() {
  const completion = await openai.chat.completions.create({
    messages: [{ role: "user", content: "Förklara kvantfysik." }],
    model: "gpt-4o-mini",
  });

  console.log(completion.choices[0].message.content);
}

main();

Installera SDK och borja gora API-anrop pa nagra minuter.

Vad folk sager om GPT-4o mini

Se vad communityt tycker om GPT-4o mini

GPT-4o mini har i princip dödat marknaden för fine-tuning av äldre modeller för enklare RAG. Kostnaderna är för låga för att ignorera.
AI_Dev_Central
reddit
Hastigheten är helt galen. Jag får tokens tillbaka nästan omedelbart för min översättningsagent.
TechCruncher
twitter
OpenAI tvingade verkligen händerna på Anthropic och Google med denna prissättning. $0.15 för 1M tokens är ett nytt golv.
hn_reader_99
hackernews
Jag bytte ut 3.5 mot mini och förbättringen i logik var synlig redan under de första fem minuterna av testning.
PromptEngineerPro
youtube
Det är äntligen tillräckligt billigt för att använda LLMs för enkel datarensning i stor skala utan en enorm molnfaktura.
DataVizWiz
reddit
Vision-prestandan för OCR är faktiskt bättre än vissa specialiserade modeller som kostar 10x mer.
VisionDev
twitter

Videor om GPT-4o mini

Se handledningar, recensioner och diskussioner om GPT-4o mini

i många av dessa fall har GPT-4o mini också ett kunskapsstoppdatum precis som de flesta av dessa modeller med kunskap upp till oktober 2023, vilket är ganska nyligen för dessa LLM:er, det är mindre än ett år

om du använder GPT-4o för att bygga din app och känner att den är för dyr, kanske du vill nedgradera och spara en hel del pengar på din API-användning, så detta är relaterat till API:et och

titta på den hastigheten, mycket snabbare eller hur? Så det kommer att vara fantastiskt, särskilt för personer som använder ChatGPT gratis, nu har de den här modellen som är bra, snabb och gratis, okej nu

Om du gör något med vision, är den faktiskt långsammare än vår flagship-modell.

vi introducerar vår mest kostnadseffektiva small model, GPT-4o mini får 82 % på MMLU och presterar för närvarande bättre än GPT-4

2,5 sekunder för GPT-4o mini, 4,6 sekunder för GPT-4o nu enligt GPT-4o mini

Den stöder upp till 16 000 output tokens per request, tänk på det som ungefär 12 000 ord.

modaliteter men GPT-4o mini som nu har rullats ut stöder endast text och vision, inte video eller ljud och ja vi

positiva nyheter, den stöder upp till 16 000 output tokens per request, tänk på det som ungefär 12 000 ord, vilket är ganska imponerande, den har kunskap upp till

Mer an bara promptar

Superladda ditt arbetsflode med AI-automatisering

Automatio kombinerar kraften av AI-agenter, webbautomatisering och smarta integrationer for att hjalpa dig astadkomma mer pa kortare tid.

AI-agenter
Webbautomatisering
Smarta arbetsfloden

Proffs-tips for GPT-4o mini

Experttips for att hjalpa dig fa ut det mesta av GPT-4o mini och uppna battre resultat.

Använd för RAG

Utnyttja den låga kostnaden för input för att utföra omfattande Retrieval Augmented Generation utan höga kostnader.

Strukturera med JSON Mode

Använd JSON mode eller parametrar för function calling för att säkerställa konsekventadatastrukturer för backend-arbetsflöden.

Batch-bearbetning

Använd OpenAI:s Batch API med denna modell för att minska kostnaderna med 50 % för icke-brådskande uppgifter.

Justering av Temperature

Ställ in en lägre temperature mellan 0,1 och 0,3 för faktaextraheringsuppgifter för att maximera precisionen.

Omdomen

Vad vara anvandare sager

Ga med tusentals nojda anvandare som har transformerat sitt arbetsflode

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Relaterat AI Models

alibaba

Qwen3-Coder-Next

alibaba

Qwen3-Coder-Next is Alibaba Cloud's elite Apache 2.0 coding model, featuring an 80B MoE architecture and 256k context window for advanced local development.

262K context
$0.12/$0.75/1M
google

Gemini 3.6 Flash Lite

Google

Gemini 3.6 Flash Lite is a high-efficiency model from Google featuring a 1M token context window and 350 tokens/sec throughput for agentic workflows.

1M context
$0.30/$2.50/1M
zhipu

GLM-4.7

Zhipu (GLM)

GLM-4.7 by Zhipu AI is a flagship 358B MoE model featuring a 200K context window, elite 73.8% SWE-bench performance, and native Deep Thinking for agentic...

200K context
$0.60/$2.20/1M
google

Gemini 3.6 Flash

Google

Gemini 3.6 Flash is Google's high-speed model featuring a 17% reduction in token consumption, $1.50/M input pricing, and advanced 3D visualization.

1M context
$1.50/$7.50/1M
minimax

MiniMax M2.5

minimax

MiniMax M2.5 is a SOTA MoE model featuring a 1M context window and elite agentic coding capabilities at disruptive pricing for autonomous agents.

1M context
$0.15/$1.20/1M
deepseek

DeepSeek-V4-Flash

DeepSeek

DeepSeek-V4-Flash is an open-weight 1M context AI model scoring 54.4% on SWE-bench at $0.14 per 1M tokens, optimized for agentic coding and reasoning.

1M context
$0.14/$0.28/1M
other

MiMo V2.5 Pro

Other

MiMo V2.5 Pro is Xiaomi's open-source 1.02T parameter MoE model featuring a 1M context window, native multimodality, and elite agentic coding performance.

1M context
$1.00/$3.00/1M
google

Gemini 3.8 Flash

Google

Gemini 3.8 Flash is Google's multimodal AI offering 1M context, 64K output, and agentic coding capabilities at $0.75 per million input tokens.

1M context
$0.75/$3.75/1M

Vanliga fragor om GPT-4o mini

Hitta svar pa vanliga fragor om GPT-4o mini