{"source":"BenchGecko","url":"https://benchgecko.ai/model/kimi-k2-5","as_of":"2026-10-05","license":"BenchGecko collected data (prices, provider offers, Gecko Tests) is CC BY 4.0 · https://creativecommons.org/licenses/by/4.0/. Benchmark scores belong to their original publishers (see sources) and are aggregated with attribution. Attribution required: \"Source: BenchGecko\" with a link.","attribution":"Source: BenchGecko · https://benchgecko.ai/model/kimi-k2-5","cite":"Kimi K2.5 · benchmarks, pricing and providers. BenchGecko, data as of 2026-10-05. https://benchgecko.ai/model/kimi-k2-5","slug":"kimi-k2-5","name":"Kimi K2.5","provider":{"name":"moonshotai","slug":"moonshotai"},"model_type":"multimodal","release_date":"2026-01-27","is_open_source":true,"status":"active","context_window":262144,"description":"Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Built on Kimi K2 with continued pretraining over approximately 15T mixed...","benchgecko_score":{"value":57.1,"rank":104,"of":312,"method":"Normalized average of public benchmark scores","method_url":"https://benchgecko.ai/methodology"},"avg_score":57.1,"list_price":{"input_usd_per_m":0.45,"output_usd_per_m":2.25,"source":"OpenRouter models API (checked daily)","as_of":"2026-10-05"},"pricing":{"input":0.45,"output":2.25},"providers":[{"provider":"SiliconFlow","endpoint":"siliconflow/int4","quantization":"int4","context_tokens":262144,"input_usd_per_m":0.45,"output_usd_per_m":2.25,"cache_read_usd_per_m":0.07,"uptime_1d_pct":99.9,"as_of":"2026-10-05"},{"provider":"AtlasCloud","endpoint":"atlas-cloud/int4","quantization":"int4","context_tokens":262144,"input_usd_per_m":0.49,"output_usd_per_m":2.5,"cache_read_usd_per_m":0.2,"uptime_1d_pct":98.45,"as_of":"2026-10-05"},{"provider":"Venice","endpoint":"venice","quantization":null,"context_tokens":256000,"input_usd_per_m":0.532,"output_usd_per_m":3.325,"cache_read_usd_per_m":0.209,"uptime_1d_pct":96.51,"as_of":"2026-10-05"},{"provider":"Novita","endpoint":"novita","quantization":null,"context_tokens":262144,"input_usd_per_m":0.57,"output_usd_per_m":2.85,"cache_read_usd_per_m":0.095,"uptime_1d_pct":98.95,"as_of":"2026-10-05"},{"provider":"Amazon Bedrock","endpoint":"amazon-bedrock/us-east-2","quantization":null,"context_tokens":262144,"input_usd_per_m":0.6,"output_usd_per_m":3,"cache_read_usd_per_m":null,"uptime_1d_pct":99.96,"as_of":"2026-10-05"}],"cheapest_provider":{"provider":"SiliconFlow","endpoint":"siliconflow/int4","quantization":"int4","context_tokens":262144,"input_usd_per_m":0.45,"output_usd_per_m":2.25,"cache_read_usd_per_m":0.07,"uptime_1d_pct":99.9,"as_of":"2026-10-05"},"providers_source":"OpenRouter endpoints API, one row per provider, refreshed daily","scores":[{"benchmark":"OpenCompass — IFEval","benchmark_slug":"oc-ifeval","score":93.9,"unit":"%","category":"language","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-ifeval"},{"benchmark":"OTIS Mock AIME 2024-2025","benchmark_slug":"otis-mock-aime-2024-2025","score":92.19,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/otis-mock-aime-2024-2025"},{"benchmark":"OpenCompass — AIME2025","benchmark_slug":"oc-aime2025","score":91.9,"unit":"%","category":"math","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-aime2025"},{"benchmark":"OpenCompass — GPQA-Diamond","benchmark_slug":"oc-gpqa-diamond","score":88.1,"unit":"%","category":"knowledge","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-gpqa-diamond"},{"benchmark":"OpenCompass — MMLU-Pro","benchmark_slug":"oc-mmlu-pro","score":86.2,"unit":"%","category":"knowledge","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-mmlu-pro"},{"benchmark":"Fiction.LiveBench","benchmark_slug":"fiction-livebench","score":86.1,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/fiction-livebench"},{"benchmark":"GPQA diamond","benchmark_slug":"gpqa-diamond","score":83.47,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/gpqa-diamond"},{"benchmark":"OpenCompass — LiveCodeBenchV6","benchmark_slug":"oc-livecodebenchv6","score":80.6,"unit":"%","category":"coding","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-livecodebenchv6"},{"benchmark":"SWE-Bench verified","benchmark_slug":"swe-bench-verified","score":73.76,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/swe-bench-verified"},{"benchmark":"ARC-AGI","benchmark_slug":"arc-agi","score":65.33,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/arc-agi"},{"benchmark":"OSWorld","benchmark_slug":"osworld","score":63.3,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/osworld"},{"benchmark":"Artificial Analysis — Agentic Index","benchmark_slug":"aa-agentic-index","score":58.94,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-agentic-index"},{"benchmark":"TutorBench","benchmark_slug":"seal-tutorbench","score":54.56,"unit":"%","category":"knowledge","source":"Scale SEAL leaderboards","source_url":"https://scale.com/leaderboard","benchmark_url":"https://benchgecko.ai/benchmark/seal-tutorbench"},{"benchmark":"Artificial Analysis — Quality Index","benchmark_slug":"aa-quality-index","score":46.81,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-quality-index"},{"benchmark":"WeirdML","benchmark_slug":"weirdml","score":45.6,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/weirdml"},{"benchmark":"Terminal Bench","benchmark_slug":"terminal-bench","score":43.2,"unit":"%","category":"coding","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/terminal-bench"},{"benchmark":"Artificial Analysis — Coding Index","benchmark_slug":"aa-coding-index","score":39.55,"unit":"index","category":"speed","source":"Artificial Analysis","source_url":"https://artificialanalysis.ai","benchmark_url":"https://benchgecko.ai/benchmark/aa-coding-index"},{"benchmark":"SimpleBench","benchmark_slug":"simplebench","score":36.16,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/simplebench"},{"benchmark":"SimpleQA Verified","benchmark_slug":"simpleqa-verified","score":34.3,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/simpleqa-verified"},{"benchmark":"OpenCompass — HLE","benchmark_slug":"oc-hle","score":28.6,"unit":"%","category":"knowledge","source":"OpenCompass","source_url":"https://rank.opencompass.org.cn","benchmark_url":"https://benchgecko.ai/benchmark/oc-hle"},{"benchmark":"FrontierMath-2025-02-28-Private","benchmark_slug":"frontiermath-2025-02-28-private","score":27.9,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiermath-2025-02-28-private"},{"benchmark":"HLE","benchmark_slug":"hle","score":20.56,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/hle"},{"benchmark":"Cl Bench","benchmark_slug":"cl-bench","score":19.3,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/cl-bench"},{"benchmark":"APEX-Agents","benchmark_slug":"apex-agents","score":14.4,"unit":"%","category":"agentic","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/apex-agents"},{"benchmark":"Cl Bench Life","benchmark_slug":"cl-bench-life","score":13.2,"unit":"%","category":"general","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/cl-bench-life"},{"benchmark":"Chess Puzzles","benchmark_slug":"chess-puzzles","score":12,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/chess-puzzles"},{"benchmark":"ARC-AGI-2","benchmark_slug":"arc-agi-2","score":11.81,"unit":"%","category":"reasoning","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/arc-agi-2"},{"benchmark":"PostTrainBench","benchmark_slug":"posttrainbench","score":10.26,"unit":"%","category":"knowledge","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/posttrainbench"},{"benchmark":"FrontierMath-Tier-4-2025-07-01-Private","benchmark_slug":"frontiermath-tier-4-2025-07-01-private","score":7,"unit":"%","category":"math","source":"Epoch AI Benchmarking Hub","source_url":"https://epoch.ai/data/ai-benchmarking-dashboard","benchmark_url":"https://benchgecko.ai/benchmark/frontiermath-tier-4-2025-07-01-private"}],"gecko_tests":{"gecko_score":null,"rank":null,"tests_taken":2,"tests":[{"test":"who-are-you","name":"Who Are You","grade":"B","value":100,"verdict":"Knows who made it","url":"https://benchgecko.ai/gecko-tests/who-are-you"},{"test":"tokenizer-tax","name":"Tokenizer Tax","grade":"E","value":0.5,"verdict":"100% more tokens outside English","url":"https://benchgecko.ai/gecko-tests/tokenizer-tax"}],"scorecard_url":"https://benchgecko.ai/gecko-tests/scorecard"},"links":{"page":"https://benchgecko.ai/model/kimi-k2-5","json":"https://benchgecko.ai/api/v1/models/kimi-k2-5","price_history":"https://benchgecko.ai/api/v1/price-history/kimi-k2-5","provider_prices":"https://benchgecko.ai/pricing/arbitrage/kimi-k2-5"}}