{"source":"BenchGecko","url":"https://benchgecko.ai/model/claude-opus-5-5","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/claude-opus-5-5","cite":"Claude Opus 5.5 · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/claude-opus-5-5","slug":"claude-opus-5-5","name":"Claude Opus 5.5","provider":{"name":"Anthropic","slug":"anthropic"},"model_type":"multimodal","release_date":"2026-09-22","is_open_source":false,"status":"active","context_window":1000000,"description":"Claude Opus 5.5 is Anthropic's flagship model for demanding reasoning, coding, and long-horizon agentic work, succeeding Claude Opus 5. It is particularly strong at multi-step changes in large codebases, code...","benchgecko_score":{"value":96.8,"rank":3,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":96.8,"list_price":{"input_usd_per_m":4,"output_usd_per_m":20,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":4,"output":20},"providers":[{"provider":"Amazon Bedrock","endpoint":"amazon-bedrock","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":99.05,"as_of":"2026-10-05"},{"provider":"Anthropic","endpoint":"anthropic","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":99.99,"as_of":"2026-10-05"},{"provider":"Azure","endpoint":"azure/global","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":100,"as_of":"2026-10-05"},{"provider":"Claude Platform on AWS","endpoint":"claude-on-aws","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":99.98,"as_of":"2026-10-05"},{"provider":"Google","endpoint":"google-vertex/global","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":99.97,"as_of":"2026-10-05"},{"provider":"Amazon Bedrock","endpoint":"amazon-bedrock/eu-west-1","quantization":null,"context_tokens":1000000,"input_usd_per_m":4.4,"output_usd_per_m":22,"cache_read_usd_per_m":0.22,"uptime_1d_pct":100,"as_of":"2026-10-05"},{"provider":"Amazon Bedrock","endpoint":"amazon-bedrock/us-east-1","quantization":null,"context_tokens":1000000,"input_usd_per_m":4.4,"output_usd_per_m":22,"cache_read_usd_per_m":0.22,"uptime_1d_pct":99.06,"as_of":"2026-10-05"},{"provider":"Azure","endpoint":"azure/us","quantization":null,"context_tokens":1000000,"input_usd_per_m":4.4,"output_usd_per_m":22,"cache_read_usd_per_m":0.22,"uptime_1d_pct":null,"as_of":"2026-10-05"},{"provider":"Google","endpoint":"google-vertex/europe","quantization":null,"context_tokens":1000000,"input_usd_per_m":4.4,"output_usd_per_m":22,"cache_read_usd_per_m":0.22,"uptime_1d_pct":99.99,"as_of":"2026-10-05"},{"provider":"Google","endpoint":"google-vertex/us","quantization":null,"context_tokens":1000000,"input_usd_per_m":4.4,"output_usd_per_m":22,"cache_read_usd_per_m":0.22,"uptime_1d_pct":100,"as_of":"2026-10-05"},{"provider":"Anthropic","endpoint":"anthropic/fast","quantization":null,"context_tokens":1000000,"input_usd_per_m":8,"output_usd_per_m":40,"cache_read_usd_per_m":0.4,"uptime_1d_pct":99.99,"as_of":"2026-10-05"}],"cheapest_provider":{"provider":"Amazon Bedrock","endpoint":"amazon-bedrock","quantization":null,"context_tokens":1000000,"input_usd_per_m":4,"output_usd_per_m":20,"cache_read_usd_per_m":0.2,"uptime_1d_pct":99.05,"as_of":"2026-10-05"},"providers_source":"OpenRouter endpoints API, one row per provider, refreshed daily","scores":[{"benchmark":"OTIS Mock AIME 2024-2025","benchmark_slug":"otis-mock-aime-2024-2025","score":100,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/otis-mock-aime-2024-2025"},{"benchmark":"Proofbench","benchmark_slug":"proofbench","score":100,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/proofbench"},{"benchmark":"Dtbench","benchmark_slug":"dtbench","score":98.22,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/dtbench"},{"benchmark":"ARC-AGI","benchmark_slug":"arc-agi","score":97.5,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/arc-agi"},{"benchmark":"FrontierMath-Tier-4-v2-Private","benchmark_slug":"frontiermath-tier-4-v2-private","score":95,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiermath-tier-4-v2-private"},{"benchmark":"ARC-AGI-2","benchmark_slug":"arc-agi-2","score":92.5,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/arc-agi-2"},{"benchmark":"FrontierMath-Tiers-1-3-v2-Private","benchmark_slug":"frontiermath-tiers-1-3-v2-private","score":91.23,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiermath-tiers-1-3-v2-private"},{"benchmark":"Artificial Analysis · MMMU Pro","benchmark_slug":"aa-mmmu-pro","score":87.7,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-mmmu-pro"},{"benchmark":"GPQA diamond","benchmark_slug":"gpqa-diamond","score":87.46,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/gpqa-diamond"},{"benchmark":"Artificial Analysis · Long Context Reasoning","benchmark_slug":"aa-long-context-reasoning","score":84.7,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-long-context-reasoning"},{"benchmark":"Lmca","benchmark_slug":"lmca","score":80.27,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/lmca"},{"benchmark":"Mirrorcode","benchmark_slug":"mirrorcode","score":77.4,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/mirrorcode"},{"benchmark":"Furniture Assembly","benchmark_slug":"furniture-assembly","score":76.19,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/furniture-assembly"},{"benchmark":"APEX-Agents","benchmark_slug":"apex-agents","score":73.5,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/apex-agents"},{"benchmark":"SimpleQA Verified","benchmark_slug":"simpleqa-verified","score":72.2,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/simpleqa-verified"},{"benchmark":"Ebr Bench","benchmark_slug":"ebr-bench","score":71.43,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/ebr-bench"},{"benchmark":"Mystery Game Puzzles","benchmark_slug":"mystery-game-puzzles","score":68.05,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/mystery-game-puzzles"},{"benchmark":"Artificial Analysis · GDPval","benchmark_slug":"aa-gdpval","score":67.3,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-gdpval"},{"benchmark":"Artificial Analysis · SciCode","benchmark_slug":"aa-scicode","score":66.9,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-scicode"},{"benchmark":"Frontierswe","benchmark_slug":"frontierswe","score":62.33,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontierswe"},{"benchmark":"Artificial Analysis · Humanity's Last Exam","benchmark_slug":"aa-humanitys-last-exam","score":61.4,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-humanitys-last-exam"},{"benchmark":"Artificial Analysis — Quality Index","benchmark_slug":"aa-quality-index","score":57.62,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-quality-index"},{"benchmark":"Frontiercode","benchmark_slug":"frontiercode","score":54.64,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiercode"},{"benchmark":"Artificial Analysis · CritPt","benchmark_slug":"aa-critpt","score":31.7,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-critpt"}],"gecko_tests":{"gecko_score":65,"rank":3,"tests_taken":4,"tests":[{"test":"who-are-you","name":"Who Are You","grade":"B","value":100,"verdict":"Knows who made it","url":"https://benchgecko.ai/gecko-tests/who-are-you"},{"test":"censorship-index","name":"Censorship Index","grade":"A","value":100,"verdict":"Answers almost everything","url":"https://benchgecko.ai/gecko-tests/censorship-index"},{"test":"knowledge-horizon","name":"Knowledge Horizon","grade":"A","value":80,"verdict":"Knows news up to May 2026","url":"https://benchgecko.ai/gecko-tests/knowledge-horizon"},{"test":"tokenizer-tax","name":"Tokenizer Tax","grade":"E","value":27.4,"verdict":"73% more tokens outside English","url":"https://benchgecko.ai/gecko-tests/tokenizer-tax"}],"scorecard_url":"https://benchgecko.ai/gecko-tests/scorecard"},"links":{"page":"https://benchgecko.ai/model/claude-opus-5-5","json":"https://benchgecko.ai/api/v1/models/claude-opus-5-5","price_history":"https://benchgecko.ai/api/v1/price-history/claude-opus-5-5","provider_prices":"https://benchgecko.ai/pricing/arbitrage/claude-opus-5-5"}}