{"source":"BenchGecko","url":"https://benchgecko.ai/model/gpt-5-3-codex","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/gpt-5-3-codex","cite":"GPT-5.3-Codex · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/gpt-5-3-codex","slug":"gpt-5-3-codex","name":"GPT-5.3-Codex","provider":{"name":"OpenAI","slug":"openai"},"model_type":"multimodal","release_date":"2026-02-24","is_open_source":false,"status":"active","context_window":400000,"description":"GPT-5.3-Codex is OpenAI’s most advanced agentic coding model, combining the frontier software engineering performance of GPT-5.2-Codex with the broader reasoning and professional knowledge capabilities of GPT-5.2. It achieves state-of-the-art results...","benchgecko_score":{"value":68.1,"rank":45,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":68.1,"list_price":{"input_usd_per_m":1.75,"output_usd_per_m":14,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":1.75,"output":14},"providers":[{"provider":"Azure","endpoint":"azure","quantization":null,"context_tokens":400000,"input_usd_per_m":1.75,"output_usd_per_m":14,"cache_read_usd_per_m":0.175,"uptime_1d_pct":100,"as_of":"2026-10-05"},{"provider":"OpenAI","endpoint":"openai","quantization":null,"context_tokens":400000,"input_usd_per_m":1.75,"output_usd_per_m":14,"cache_read_usd_per_m":0.175,"uptime_1d_pct":100,"as_of":"2026-10-05"},{"provider":"OpenAI","endpoint":"openai/fast","quantization":null,"context_tokens":400000,"input_usd_per_m":3.5,"output_usd_per_m":28,"cache_read_usd_per_m":0.35,"uptime_1d_pct":null,"as_of":"2026-10-05"}],"cheapest_provider":{"provider":"Azure","endpoint":"azure","quantization":null,"context_tokens":400000,"input_usd_per_m":1.75,"output_usd_per_m":14,"cache_read_usd_per_m":0.175,"uptime_1d_pct":100,"as_of":"2026-10-05"},"providers_source":"OpenRouter endpoints API, one row per provider, refreshed daily","scores":[{"benchmark":"Artificial Analysis · GPQA Diamond","benchmark_slug":"aa-gpqa-diamond","score":91.5,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-gpqa-diamond"},{"benchmark":"Artificial Analysis · tau2-Bench Telecom","benchmark_slug":"aa-tau2-bench","score":86,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-tau2-bench"},{"benchmark":"Artificial Analysis · Long Context Reasoning","benchmark_slug":"aa-long-context-reasoning","score":83.3,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-long-context-reasoning"},{"benchmark":"WeirdML","benchmark_slug":"weirdml","score":79.3,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/weirdml"},{"benchmark":"Artificial Analysis · MMMU Pro","benchmark_slug":"aa-mmmu-pro","score":78.5,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-mmmu-pro"},{"benchmark":"Terminal Bench","benchmark_slug":"terminal-bench","score":77.3,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/terminal-bench"},{"benchmark":"Artificial Analysis · IFBench","benchmark_slug":"aa-ifbench","score":75.4,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-ifbench"},{"benchmark":"SWE-Bench verified","benchmark_slug":"swe-bench-verified","score":74.79,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/swe-bench-verified"},{"benchmark":"Metr Time Horizons","benchmark_slug":"metr-time-horizons","score":74.54,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/metr-time-horizons"},{"benchmark":"Artificial Analysis — Agentic Index","benchmark_slug":"aa-agentic-index","score":62.19,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-agentic-index"},{"benchmark":"Artificial Analysis — Coding Index","benchmark_slug":"aa-coding-index","score":53.1,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-coding-index"},{"benchmark":"Artificial Analysis · Terminal-Bench Hard","benchmark_slug":"aa-terminal-bench-hard","score":53,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-terminal-bench-hard"},{"benchmark":"Artificial Analysis · Humanity's Last Exam","benchmark_slug":"aa-humanitys-last-exam","score":42.5,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-humanitys-last-exam"},{"benchmark":"SWE Atlas — Codebase QnA","benchmark_slug":"seal-swe-atlas-codebase-qna","score":32.6,"unit":"%","category":"agentic","source":"Scale SEAL leaderboards","source_url":"https://scale.com/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/seal-swe-atlas-codebase-qna"},{"benchmark":"Artificial Analysis — Quality Index","benchmark_slug":"aa-quality-index","score":32.5,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-quality-index"},{"benchmark":"APEX-Agents","benchmark_slug":"apex-agents","score":31.7,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/apex-agents"},{"benchmark":"PostTrainBench","benchmark_slug":"posttrainbench","score":17.76,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/posttrainbench"},{"benchmark":"Artificial Analysis · CritPt","benchmark_slug":"aa-critpt","score":16.9,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-critpt"}],"gecko_tests":null,"links":{"page":"https://benchgecko.ai/model/gpt-5-3-codex","json":"https://benchgecko.ai/api/v1/models/gpt-5-3-codex","price_history":"https://benchgecko.ai/api/v1/price-history/gpt-5-3-codex","provider_prices":"https://benchgecko.ai/pricing/arbitrage/gpt-5-3-codex"}}