{"source":"BenchGecko","url":"https://benchgecko.ai/model/mistral-medium-3-5","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/mistral-medium-3-5","cite":"Mistral Medium 3.5 · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/mistral-medium-3-5","slug":"mistral-medium-3-5","name":"Mistral Medium 3.5","provider":{"name":"Mistral AI","slug":"mistral"},"model_type":"multimodal","release_date":"2026-04-30","is_open_source":true,"status":"active","context_window":262144,"description":"Mistral Medium 3.5 is a dense 128B instruction-following model from Mistral AI. It supports text and image inputs with text output, and is designed for agentic workflows, coding, and complex...","benchgecko_score":{"value":25,"rank":265,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":25,"list_price":{"input_usd_per_m":1.5,"output_usd_per_m":7.5,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":1.5,"output":7.5},"providers":[],"cheapest_provider":null,"providers_source":null,"scores":[{"benchmark":"Chatbot Arena Elo — Overall","benchmark_slug":"arena-elo-overall","score":1426.93,"unit":"elo","category":"arena","source":"LMArena","source_url":"https://lmarena.ai/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/arena-elo-overall"},{"benchmark":"Chatbot Arena Elo — Coding","benchmark_slug":"arena-elo-coding","score":1262.93,"unit":"elo","category":"arena","source":"LMArena","source_url":"https://lmarena.ai/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/arena-elo-coding"},{"benchmark":"Artificial Analysis · tau2-Bench Telecom","benchmark_slug":"aa-tau2-bench","score":94.2,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-tau2-bench"},{"benchmark":"Artificial Analysis · GPQA Diamond","benchmark_slug":"aa-gpqa-diamond","score":74.8,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-gpqa-diamond"},{"benchmark":"Artificial Analysis · Long Context Reasoning","benchmark_slug":"aa-long-context-reasoning","score":69.3,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-long-context-reasoning"},{"benchmark":"Artificial Analysis · IFBench","benchmark_slug":"aa-ifbench","score":68.8,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-ifbench"},{"benchmark":"Artificial Analysis · MMMU Pro","benchmark_slug":"aa-mmmu-pro","score":64.9,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-mmmu-pro"},{"benchmark":"Dtbench","benchmark_slug":"dtbench","score":59.12,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/dtbench"},{"benchmark":"Artificial Analysis — Coding Index","benchmark_slug":"aa-coding-index","score":46.9,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-coding-index"},{"benchmark":"WeirdML","benchmark_slug":"weirdml","score":43.71,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/weirdml"},{"benchmark":"Artificial Analysis · SciCode","benchmark_slug":"aa-scicode","score":40.2,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-scicode"},{"benchmark":"Artificial Analysis · Terminal-Bench Hard","benchmark_slug":"aa-terminal-bench-hard","score":33.3,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-terminal-bench-hard"},{"benchmark":"Lmca","benchmark_slug":"lmca","score":30.66,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/lmca"},{"benchmark":"Surface Evolver Bench","benchmark_slug":"surface-evolver-bench","score":26.88,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/surface-evolver-bench"},{"benchmark":"Artificial Analysis — Agentic Index","benchmark_slug":"aa-agentic-index","score":19,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-agentic-index"},{"benchmark":"Artificial Analysis — Quality Index","benchmark_slug":"aa-quality-index","score":14.19,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-quality-index"},{"benchmark":"Artificial Analysis · Humanity's Last Exam","benchmark_slug":"aa-humanitys-last-exam","score":13.8,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-humanitys-last-exam"},{"benchmark":"Artificial Analysis · GDPval","benchmark_slug":"aa-gdpval","score":12.4,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-gdpval"},{"benchmark":"Proofbench","benchmark_slug":"proofbench","score":9,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/proofbench"},{"benchmark":"Frontiercode","benchmark_slug":"frontiercode","score":8,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiercode"},{"benchmark":"Artificial Analysis · CritPt","benchmark_slug":"aa-critpt","score":0,"unit":"%","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-critpt"}],"gecko_tests":{"gecko_score":null,"rank":null,"tests_taken":2,"tests":[{"test":"who-are-you","name":"Who Are You","grade":"E","value":66.7,"verdict":"Sometimes says it is OpenAI","url":"https://benchgecko.ai/gecko-tests/who-are-you"},{"test":"tokenizer-tax","name":"Tokenizer Tax","grade":"C","value":46.7,"verdict":"53% more tokens outside English","url":"https://benchgecko.ai/gecko-tests/tokenizer-tax"}],"scorecard_url":"https://benchgecko.ai/gecko-tests/scorecard"},"links":{"page":"https://benchgecko.ai/model/mistral-medium-3-5","json":"https://benchgecko.ai/api/v1/models/mistral-medium-3-5","price_history":"https://benchgecko.ai/api/v1/price-history/mistral-medium-3-5","provider_prices":null}}