{"source":"BenchGecko","url":"https://benchgecko.ai/model/qwen-2-5-72b-instruct","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/qwen-2-5-72b-instruct","cite":"Qwen2.5 72B Instruct · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/qwen-2-5-72b-instruct","slug":"qwen-2-5-72b-instruct","name":"Qwen2.5 72B Instruct","provider":{"name":"Alibaba Qwen","slug":"alibaba"},"model_type":"text","release_date":"2024-09-19","is_open_source":true,"status":"active","context_window":32768,"description":"Qwen2.5 72B is the latest series of Qwen large language models. Qwen2.5 brings the following improvements upon Qwen2: - Significantly more knowledge and has greatly improved capabilities in coding and...","benchgecko_score":{"value":59.6,"rank":89,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":59.6,"list_price":{"input_usd_per_m":0.36,"output_usd_per_m":0.4,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":0.36,"output":0.4},"providers":[{"provider":"DeepInfra","endpoint":"deepinfra/fp8","quantization":"fp8","context_tokens":32768,"input_usd_per_m":0.36,"output_usd_per_m":0.4,"cache_read_usd_per_m":null,"uptime_1d_pct":99.39,"as_of":"2026-10-05"},{"provider":"Novita","endpoint":"novita/bf16","quantization":"bf16","context_tokens":32000,"input_usd_per_m":0.38,"output_usd_per_m":0.4,"cache_read_usd_per_m":null,"uptime_1d_pct":98.58,"as_of":"2026-10-05"}],"cheapest_provider":{"provider":"DeepInfra","endpoint":"deepinfra/fp8","quantization":"fp8","context_tokens":32768,"input_usd_per_m":0.36,"output_usd_per_m":0.4,"cache_read_usd_per_m":null,"uptime_1d_pct":99.39,"as_of":"2026-10-05"},"providers_source":"OpenRouter endpoints API, one row per provider, refreshed daily","scores":[{"benchmark":"Chatbot Arena Elo — Overall","benchmark_slug":"arena-elo-overall","score":1302.85,"unit":"elo","category":"arena","source":"LMArena","source_url":"https://lmarena.ai/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/arena-elo-overall"},{"benchmark":"ARC AI2","benchmark_slug":"arc-ai2","score":92.67,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/arc-ai2"},{"benchmark":"IFEval","benchmark_slug":"hf-ifeval","score":86.38,"unit":"%","category":"language","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-ifeval"},{"benchmark":"CMMLU","benchmark_slug":"cmmlu","score":85.67,"unit":"%","category":"knowledge","source":"Published CJK benchmark suites","source_url":null,"benchmark_url":"https://benchgecko.ai/benchmark/cmmlu"},{"benchmark":"MMLU","benchmark_slug":"mmlu","score":80.4,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/mmlu"},{"benchmark":"HellaSwag","benchmark_slug":"hellaswag","score":79.73,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/hellaswag"},{"benchmark":"BBH","benchmark_slug":"bbh","score":73.07,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/bbh"},{"benchmark":"TriviaQA","benchmark_slug":"triviaqa","score":71.9,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/triviaqa"},{"benchmark":"Aider — Code Editing","benchmark_slug":"aider-edit","score":65.4,"unit":"%","category":"coding","source":"Aider leaderboards","source_url":"https://aider.chat/docs/leaderboards/","benchmark_url":"https://benchgecko.ai/benchmark/aider-edit"},{"benchmark":"PIQA","benchmark_slug":"piqa","score":65.2,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/piqa"},{"benchmark":"VideoMME","benchmark_slug":"videomme","score":64.67,"unit":"%","category":"multimodal","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/videomme"},{"benchmark":"Winogrande","benchmark_slug":"winogrande","score":64.6,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/winogrande"},{"benchmark":"MATH level 5","benchmark_slug":"math-level-5","score":63.17,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/math-level-5"},{"benchmark":"GeoBench","benchmark_slug":"geobench","score":62,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/geobench"},{"benchmark":"BBH (HuggingFace)","benchmark_slug":"hf-bbh","score":61.87,"unit":"%","category":"general","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-bbh"},{"benchmark":"MATH Level 5","benchmark_slug":"hf-math-lvl5","score":59.82,"unit":"%","category":"math","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-math-lvl5"},{"benchmark":"MMLU-PRO","benchmark_slug":"hf-mmlu-pro","score":51.4,"unit":"%","category":"knowledge","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-mmlu-pro"},{"benchmark":"Dtbench","benchmark_slug":"dtbench","score":38.22,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/dtbench"},{"benchmark":"Metr Time Horizons","benchmark_slug":"metr-time-horizons","score":35.78,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/metr-time-horizons"},{"benchmark":"GPQA diamond","benchmark_slug":"gpqa-diamond","score":32.2,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/gpqa-diamond"},{"benchmark":"GPQA","benchmark_slug":"hf-gpqa","score":16.67,"unit":"%","category":"knowledge","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-gpqa"},{"benchmark":"Balrog","benchmark_slug":"balrog","score":16.2,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/balrog"},{"benchmark":"WeirdML","benchmark_slug":"weirdml","score":15.97,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/weirdml"},{"benchmark":"Lmca","benchmark_slug":"lmca","score":15.79,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/lmca"},{"benchmark":"MUSR","benchmark_slug":"hf-musr","score":11.74,"unit":"%","category":"reasoning","source":"Hugging Face Open LLM Leaderboard (archived)","source_url":"https://huggingface.co/spaces/open-llm-leaderboard/open_llm_leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/hf-musr"},{"benchmark":"OTIS Mock AIME 2024-2025","benchmark_slug":"otis-mock-aime-2024-2025","score":7.96,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/otis-mock-aime-2024-2025"},{"benchmark":"The Agent Company","benchmark_slug":"the-agent-company","score":5.7,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/the-agent-company"},{"benchmark":"OSWorld","benchmark_slug":"osworld","score":5,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/osworld"}],"gecko_tests":null,"links":{"page":"https://benchgecko.ai/model/qwen-2-5-72b-instruct","json":"https://benchgecko.ai/api/v1/models/qwen-2-5-72b-instruct","price_history":"https://benchgecko.ai/api/v1/price-history/qwen-2-5-72b-instruct","provider_prices":"https://benchgecko.ai/pricing/arbitrage/qwen-2-5-72b-instruct"}}