openai

GPT-5.3 Codex

مدل GPT-5.3 Codex، به عنوان frontier model و coding agent شرکت OpenAI در سال ۲۰۲۶، دارای context window با ظرفیت ۴۰۰K، امتیاز ۷۷.۳ در Terminal-Bench و منطقی...

Coding AgentGPT-5OpenAIمهندسی نرم‌افزارهوش مصنوعی خودمختار
openai logoopenaiGPT۵ فوریه ۲۰۲۶
پنجره زمینه
400Kتوکن
حداکثر خروجی
128Kتوکن
قیمت ورودی
$1.75/ 1M
قیمت خروجی
$14.00/ 1M
حالت:TextImageAudioVideo
قابلیت‌ها:بیناییابزارهااستریمینگاستدلال
معیارها
GPQA
81%
GPQA: سوالات علمی سطح تحصیلات تکمیلی. معیار دقیق با 448 سوال از زیست‌شناسی، فیزیک و شیمی. کارشناسان دکترا فقط 65-74% دقت دارند. GPT-5.3 Codex امتیاز 81% در این معیار کسب کرد.
HLE
36%
HLE: استدلال سطح کارشناسی. توانایی مدل در نشان دادن استدلال سطح کارشناسی در حوزه‌های تخصصی را آزمایش می‌کند. GPT-5.3 Codex امتیاز 36% در این معیار کسب کرد.
MMLU
93%
MMLU: درک زبان چندوظیفه‌ای گسترده. معیار جامع با 16000 سوال در 57 موضوع دانشگاهی. GPT-5.3 Codex امتیاز 93% در این معیار کسب کرد.
MMLU Pro
83%
MMLU Pro: نسخه حرفه‌ای MMLU. نسخه بهبود یافته MMLU با 12032 سوال و فرمت 10 گزینه‌ای سخت‌تر. GPT-5.3 Codex امتیاز 83% در این معیار کسب کرد.
SimpleQA
58%
SimpleQA: معیار دقت واقعی. توانایی مدل در ارائه پاسخ‌های دقیق و واقعی را آزمایش می‌کند. GPT-5.3 Codex امتیاز 58% در این معیار کسب کرد.
IFEval
94%
IFEval: ارزیابی پیروی از دستورالعمل. اندازه‌گیری می‌کند مدل چقدر خوب از دستورالعمل‌ها و محدودیت‌های خاص پیروی می‌کند. GPT-5.3 Codex امتیاز 94% در این معیار کسب کرد.
AIME 2025
94%
AIME 2025: امتحان ریاضی دعوتی آمریکا. مسائل ریاضی سطح مسابقه از امتحان معتبر AIME. GPT-5.3 Codex امتیاز 94% در این معیار کسب کرد.
MATH
96%
MATH: حل مسئله ریاضی. معیار جامع ریاضی که حل مسئله در جبر، هندسه، حساب دیفرانسیل را آزمایش می‌کند. GPT-5.3 Codex امتیاز 96% در این معیار کسب کرد.
GSM8k
99%
GSM8k: ریاضی دبستان 8K. 8500 مسئله ریاضی کلامی سطح دبستان. GPT-5.3 Codex امتیاز 99% در این معیار کسب کرد.
MGSM
96%
MGSM: ریاضی دبستان چندزبانه. معیار GSM8k ترجمه شده به 10 زبان. GPT-5.3 Codex امتیاز 96% در این معیار کسب کرد.
MathVista
78%
MathVista: استدلال بصری ریاضی. توانایی حل مسائل ریاضی با عناصر بصری را آزمایش می‌کند. GPT-5.3 Codex امتیاز 78% در این معیار کسب کرد.
SWE-Bench
57%
SWE-Bench: معیار مهندسی نرم‌افزار. مدل‌های AI سعی می‌کنند مسائل واقعی GitHub را در پروژه‌های Python حل کنند. GPT-5.3 Codex امتیاز 57% در این معیار کسب کرد.
HumanEval
93%
HumanEval: مسائل برنامه‌نویسی Python. 164 مسئله برنامه‌نویسی که مدل‌ها باید پیاده‌سازی صحیح توابع Python تولید کنند. GPT-5.3 Codex امتیاز 93% در این معیار کسب کرد.
LiveCodeBench
71%
LiveCodeBench: معیار کدنویسی زنده. توانایی‌های کدنویسی را در چالش‌های برنامه‌نویسی واقعی به‌روز شده آزمایش می‌کند. GPT-5.3 Codex امتیاز 71% در این معیار کسب کرد.
MMMU
84%
MMMU: درک چندحالته. معیار درک چندحالته در 30 موضوع دانشگاهی. GPT-5.3 Codex امتیاز 84% در این معیار کسب کرد.
MMMU Pro
64%
MMMU Pro: نسخه حرفه‌ای MMMU. نسخه بهبود یافته MMMU با سوالات چالش‌برانگیزتر. GPT-5.3 Codex امتیاز 64% در این معیار کسب کرد.
ChartQA
91%
ChartQA: پرسش و پاسخ نمودار. توانایی درک و تحلیل اطلاعات از نمودارها را آزمایش می‌کند. GPT-5.3 Codex امتیاز 91% در این معیار کسب کرد.
DocVQA
95%
DocVQA: پرسش و پاسخ بصری سند. توانایی استخراج اطلاعات از تصاویر سند را آزمایش می‌کند. GPT-5.3 Codex امتیاز 95% در این معیار کسب کرد.
Terminal-Bench
77.3%
Terminal-Bench: وظایف ترمینال/CLI. توانایی انجام عملیات خط فرمان را آزمایش می‌کند. GPT-5.3 Codex امتیاز 77.3% در این معیار کسب کرد.
ARC-AGI
54%
ARC-AGI: انتزاع و استدلال. هوش سیال را از طریق پازل‌های تشخیص الگوی جدید آزمایش می‌کند. GPT-5.3 Codex امتیاز 54% در این معیار کسب کرد.

درباره GPT-5.3 Codex

درباره قابلیت‌های GPT-5.3 Codex، ویژگی‌ها و نحوه کمک به شما در دستیابی به نتایج بهتر بیاموزید.

عصر جدید توسعه خودمختار

GPT-5.3 Codex توانمندترین مدل agentic کدنویسی OpenAI است. این مدل شکاف بین تولید کد ایستا و مهندسی نرم‌افزار خودمختار را پر می‌کند. با تکیه بر معماری GPT-5، این مدل دانش حرفه‌ای تخصصی را با استدلال پیشرفته ترکیب کرده تا وظایف طولانی‌مدت مانند مدیریت سیستم، نظارت بر استقرار و ری‌فکتور کردن معماری را انجام دهد. این مدل شامل قابلیت هدایت در حین انجام کار (mid-task steering) است که به توسعه‌دهندگان اجازه می‌دهد در زمان واقعی با عامل تعامل داشته و آن را در پروژه‌های پیچیده هدایت کنند.

هوش بازگشتی و عملکرد

OpenAI این مدل را با استفاده از نسخه‌های اولیه خود برای دیباگ کردن و بهینه‌سازی فرآیند استقرار، آموزش داده است. این مدل گام مهمی به سمت سیستم‌های خودبهبوددهنده است. این مدل در محیط‌های Terminal-Bench 2.0 برتری دارد و توانایی مدیریت ترمینال‌های زنده، اجرای تست‌های واحد و اصلاح تکراری باگ‌ها بدون دخالت انسان را نشان می‌دهد. این رویکرد آموزش بازگشتی منجر به استفاده بهینه از tokenها و یک context window با ظرفیت ۴۰۰ هزار token شده است که می‌تواند کل مخازن سازمانی را در یک مرحله پردازش کند.

یکپارچه‌سازی حرفه‌ای بی‌نقص

این مدل از طریق اپلیکیشن اختصاصی Codex، CLI و افزونه‌های IDE در دسترس بوده و در جریان‌های کاری مدرن ادغام می‌شود. این مدل در شناسایی اکسپلویت‌های روز صفر، بهینه‌سازی معماری خط لوله داده و انجام حسابرسی‌های سطح عملیاتی از پایگاه‌های کد قدیمی مؤثر است. با منطق برتر و قیمت‌گذاری رقابتی، این ابزار به عنوان یک راهکار با کارایی بالا برای وظایف مهندسی نرم‌افزار حساس عمل می‌کند.

GPT-5.3 Codex

موارد استفاده برای GPT-5.3 Codex

روش‌های مختلف استفاده از GPT-5.3 Codex برای دستیابی به نتایج عالی را کشف کنید.

مهندسی نرم‌افزار خودمختار

معماری و ساخت پروژه‌های نرم‌افزاری ماژولار و چند فایلی بر اساس مشخصات سطح بالا.

حسابرسی کدهای عملیاتی (Production)

تحلیل پایگاه‌های کد زنده برای یافتن مشکلات همزمانی (concurrency)، نشت حافظه و بدهی‌های فنی معماری.

اتوماسیون DevOps به صورت real-time

مدیریت جریان‌های کاری مبتنی بر ترمینال شامل راه‌اندازی سرور، استقرار کانتینر و مقیاس‌پذیری کلاستر.

رفع آسیب‌پذیری‌های امنیت سایبری

شناسایی و رفع اکسپلویت‌های روز صفر و آسیب‌پذیری‌های نرم‌افزاری با استفاده از منطق دفاعی بسیار توانمند.

نمونه‌سازی تعاملی

تولید صفحات فرود (landing pages) و وب‌اپلیکیشن‌های آماده برای محیط production از روی وایرفریم‌های دست‌نویس یا promptهای ناقص.

معماری خط لوله داده (Data Pipeline)

ردیابی و بهینه‌سازی جریان‌های داده پیچیده در چندین لایه پردازشی و محیط‌های ناهمگام (asynchronous).

نقاط قوت

محدودیت‌ها

منطق برنامه‌نویسی state-of-the-art: کسب امتیاز پیشرو در صنعت ۷۷.۳٪ در Terminal-Bench 2.0 و عملکرد برتر در SWE-Bench Pro.
اختصار عملکردی: گاهی اوقات اختصار عملکردی را بر عمق معماری بسیار زیاد که در مدل‌هایی مانند o3-pro یافت می‌شود، ترجیح می‌دهد.
بهترین نسبت قیمت به عملکرد: ارائه قابلیت‌های agentic در سطح frontier با هزینه‌ای در حدود یک‌هفتم رقبا نظیر Opus 4.6.
پیش‌فرض‌های زیبایی‌شناسی: در حالی که از نظر منطقی بی‌نقص است، طراحی‌های UI اولیه برای اپلیکیشن‌ها ممکن است گاهی فاقد ظرافت‌های بصری مدرن باشند.
بهینه‌سازی خودکار بازگشتی: ساخته‌شده با استفاده از معماری خود برای شناسایی باگ‌ها و بهینه‌سازی آموزش جهت افزایش کارایی.
شکاف‌های منابع در وظایف حساس: گاهی اوقات در شبیه‌سازی‌های پیچیده سخت‌افزاری-نرم‌افزاری، وظایف پاکسازی منابع خاص را نادیده می‌گیرد.
هدایت تعاملی real-time: قابلیت منحصربه‌فرد برای دریافت دستورالعمل‌های انسانی در میانه وظیفه، که نیاز به حلقه‌های تکرار طولانی را کاهش می‌دهد.
اصطکاک اکوسیستم: دسترسی اصلی برای اپلیکیشن و CLI تخصصی Codex بهینه شده است که برای کاربران استاندارد API دارای منحنی یادگیری است.

شروع سریع API

openai/gpt-5.3-codex

مشاهده مستندات
openai SDK
import OpenAI from 'openai';

const openai = new OpenAI();

async function main() {
  const completion = await openai.chat.completions.create({
    messages: [{ role: 'user', content: 'Audit this Swift actor for race conditions' }],
    model: 'gpt-5.3-codex',
  });

  console.log(completion.choices[0].message.content);
}

main();

SDK را نصب کنید و در عرض چند دقیقه شروع به فراخوانی API کنید.

مردم درباره GPT-5.3 Codex چه می‌گویند

ببینید جامعه درباره GPT-5.3 Codex چه فکر می‌کند

GPT-5.3 Codex کمتر شبیه به یک چت‌بات عمومی و بیشتر شبیه به یک مدل مهندسی خالص به نظر می‌رسد.
Federal-Piano8695
reddit
Codex کدهای بهتری را با قیمتی حدود یک‌هفتم ارائه می‌دهد. عملکرد به ازای قیمت، واقعاً مسخره (عالی) است.
sergeykarayev
reddit
فقط دستورات من را اجرا نمی‌کرد، بلکه تصمیمات هوشمندانه‌ای می‌گرفت. انگار قدرت قضاوت داشت.
mattshumer_
twitter
کل ارکستراسیون بک‌اند خود را به عوامل (agents) Codex منتقل کردیم و قابلیت اطمینان آن به‌طور وحشتناکی بالاست.
HackerNewsUser99
hackernews
GPT 5.3 Codex رکورد جدیدی در Terminal-Bench 2.0 ثبت کرد. ۷۷.۳٪ یک جهش عظیم نسبت به نسخه قبلی است.
bridgemindai
twitter
توانایی کار با context window ۴۰۰ هزارتایی، امکان حسابرسی کل مخازن سازمانی را در یک مرحله فراهم کرده است.
cdcore
other

ویدیوهای درباره GPT-5.3 Codex

آموزش‌ها، بررسی‌ها و بحث‌های درباره GPT-5.3 Codex را تماشا کنید

من نسخه خشک‌وخالی را ترجیح می‌دهم که در آن مجبورم کمتر بخوانم تا اینکه بخواهم روش تعاملی و جذاب‌تری داشته باشم.

- آره. من، من نمی‌توانم. برخی مقایسه‌های دیگر این‌گونه‌اند که Opus مثل همکارِ کمی بازیگوش است، اما واقعاً خنده‌دار است و نگهش می‌داری. و Codex مثل آن آدم عجیبی در گوشه اتاق است که نمی‌خواهی با او صحبت کنی، اما قابل اعتماد است و کار را تمام می‌کند.

- اگر، اگر کسی سوییچ کند، من یک هفته زمان می‌دهم تا واقعاً حسِ شهودی نسبت به آن پیدا کنید.

هدایت در حین انجام کار (Mid-task steering). این ویژگی در حال حاضر مختص Codex است. می‌توانید در حالی که مدل در حال کار است، آن را هدایت مجدد کنید.

بنچمارک OS World توانایی کنترل دسکتاپ را اندازه‌گیری می‌کند. نسخه قبلی Codex حدود ۳۸٪ کسب کرد. این نسخه، ۶۴٪. سطح انسان حدود ۷۲٪ است، و اینجاست که پیشرفت بزرگ خود را نشان می‌دهد. این مدل به طور کلی دارد به سطح... نزدیک می‌شود

اکوسیستم پیرامون این ابزار نیز در حال گسترش است. یک اپلیکیشن دسکتاپ جدید به نام Codex هم‌زمان با این مدل عرضه شد که برای مدیریت AI agentها در بازه‌های زمانی چند روزه یا چند هفته‌ای و مدیریت چندین... طراحی شده است

مدل GPT-5.3 Codex نقشی اساسی در خلق خودش داشت... این تقریباً یک فرآیند خودبهبودی خودمختار است.

نظر من. حالا، یکی از نقاط فروش اصلی GPT 5.3 Codex این است که می‌توانید آن را در حین انجام کار هدایت کنید، و این با هر چیزی که جای دیگری دیده‌ام بسیار متفاوت است. بنابراین، بگذارید...

استفاده. در اینجا بنچمارک OS World را داریم، و امتیاز آن تقریباً دو برابر نسخه قبلی یعنی GPT 5.2 است و تا ۶۴.۷ بالا آمده است. و OS World نشان‌دهنده توانایی مدل در کنترل کامپیوتر است. پس این شامل درک... می‌شود

بیشتر از فقط پرامپت

گردش کار خود را با اتوماسیون AI

Automatio قدرت عامل‌های AI، اتوماسیون وب و ادغام‌های هوشمند را ترکیب می‌کند تا به شما کمک کند در زمان کمتر بیشتر انجام دهید.

عامل‌های AI
اتوماسیون وب
گردش‌کارهای هوشمند

نکات حرفه‌ای برای GPT-5.3 Codex

نکات تخصصی برای کمک به شما در استفاده حداکثری از GPT-5.3 Codex و دستیابی به نتایج بهتر.

فعال‌سازی هدایت real-time

رفتار follow-up را در تنظیمات Codex فعال کنید تا بتوانید مدل را در میان فرآیند ساخت، بدون از دست دادن context، هدایت کنید.

استفاده از حالت Plan

برای ری‌فکتور کردن‌های پیچیده از دستور Plan استفاده کنید تا مدل قبل از اعمال تغییرات، استراتژی خود را ترسیم کند.

بررسی دسته‌ای Pull Requestها

کل شاخه‌های یک ویژگی (feature branches) را به داخل context window ۴۰۰ هزارتایی وارد کنید تا تست‌های یکپارچه‌سازی عمیق انجام شود.

فشرده‌سازی context

در جلسات agentic طولانی‌مدت، از فشرده‌سازی بومی context استفاده کنید تا تمرکز مدل بر پروژه حفظ شود.

نظرات

کاربران ما چه می‌گویند

به هزاران کاربر راضی که گردش کار خود را متحول کرده‌اند بپیوندید

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

Jonathan Kogan

Jonathan Kogan

Co-Founder/CEO, rpatools.io

Automatio is one of the most used for RPA Tools both internally and externally. It saves us countless hours of work and we realized this could do the same for other startups and so we choose Automatio for most of our automation needs.

Mohammed Ibrahim

Mohammed Ibrahim

CEO, qannas.pro

I have used many tools over the past 5 years, Automatio is the Jack of All trades.. !! it could be your scraping bot in the morning and then it becomes your VA by the noon and in the evening it does your automations.. its amazing!

Ben Bressington

Ben Bressington

CTO, AiChatSolutions

Automatio is fantastic and simple to use to extract data from any website. This allowed me to replace a developer and do tasks myself as they only take a few minutes to setup and forget about it. Automatio is a game changer!

Sarah Chen

Sarah Chen

Head of Growth, ScaleUp Labs

We've tried dozens of automation tools, but Automatio stands out for its flexibility and ease of use. Our team productivity increased by 40% within the first month of adoption.

David Park

David Park

Founder, DataDriven.io

The AI-powered features in Automatio are incredible. It understands context and adapts to changes in websites automatically. No more broken scrapers!

Emily Rodriguez

Emily Rodriguez

Marketing Director, GrowthMetrics

Automatio transformed our lead generation process. What used to take our team days now happens automatically in minutes. The ROI is incredible.

مرتبط AI Models

zhipu

GLM-5.2

Zhipu (GLM)

GLM-5.2 is Zhipu AI's flagship open-weight model featuring a 1M context window and specialized agentic coding capabilities under an MIT license.

1M context
$1.40/$4.40/1M
alibaba

Qwen3.5-Omni

alibaba

Qwen3.5-Omni is a natively omnimodal AI by Alibaba Cloud, offering seamless audio-visual reasoning, real-time voice chat, and 256k context for low-latency apps.

256K context
$0.40/$4.80/1M
openai

GPT-5.4

OpenAI

GPT-5.4 is OpenAI's frontier model featuring a 1.05M context window and Extreme Reasoning. It excels at autonomous UI interaction and long-form data analysis.

1.1M context
$2.50/$15.00/1M
anthropic

Claude 4.5 Sonnet

Anthropic

Anthropic's Claude Sonnet 4.5 delivers world-leading coding (77.2% SWE-bench) and a 200K context window, optimized for the next generation of autonomous agents.

200K context
$3.00/$15.00/1M
moonshot

Kimi K2 Thinking

Moonshot

Kimi K2 Thinking is Moonshot AI's trillion-parameter reasoning model. It outperforms GPT-5 on HLE and supports 300 sequential tool calls autonomously for...

256K context
$0.60/$2.50/1M
openai

GPT-5.2

OpenAI

GPT-5.2 is OpenAI's flagship model for professional tasks, featuring a 400K context window, elite coding, and deep multi-step reasoning capabilities.

400K context
$1.75/$14.00/1M
alibaba

Qwen3.6-Max-Preview

alibaba

Qwen3.6-Max-Preview is Alibaba's flagship MoE model featuring 1M context, a native thinking mode, and SOTA scores in agentic coding and reasoning.

1M context
$1.25/$10.00/1M
zhipu

GLM-5

Zhipu (GLM)

GLM-5 is Zhipu AI's 744B parameter open-weight powerhouse, excelling in long-horizon agentic tasks, coding, and factual accuracy with a 200k context window.

200K context
$1.00/$3.20/1M

سوالات متداول درباره GPT-5.3 Codex

پاسخ سوالات رایج درباره GPT-5.3 Codex را بیابید