Compare · ModelsLive · 2 picked · head to head

Grok-3 mini vs Grok 3 Mini Beta

Side by side · benchmarks, pricing, and signals you can act on.

Winner summary

Grok-3 mini wins 6 of 6 shared benchmarks. Leads in coding · knowledge · language.

Category leads
coding·Grok-3 miniknowledge·Grok-3 minilanguage·Grok-3 minimath·Grok-3 minireasoning·Grok-3 mini
Hype vs Reality
Grok-3 mini
#93 by perf·no signal
QUIET
Grok 3 Mini Beta
#34 by perf·no signal
QUIET
Best value
Grok-3 mini
n/a
no price
Grok 3 Mini Beta
162.0 pts/$
$0.40/M
Vendor risk
xAI logo
xAI
$250.0B·Tier 1
Medium risk
xAI logo
xAI
$250.0B·Tier 1
Medium risk
Head to head
Grok-3 miniGrok 3 Mini Beta
Aider polyglot
Aider Polyglot · measures how well AI models can edit code across multiple programming languages using the Aider coding assistant framework.
Grok-3 mini
49.3
Grok 3 Mini Beta
49.3
HELM · GPQA
Grok-3 mini
67.5
Grok 3 Mini Beta
67.5
HELM · IFEval
Grok-3 mini
95.1
Grok 3 Mini Beta
95.1
HELM · MMLU-Pro
Grok-3 mini
79.9
Grok 3 Mini Beta
79.9
HELM · Omni-MATH
Grok-3 mini
31.8
Grok 3 Mini Beta
31.8
HELM · WildBench
Grok-3 mini
65.1
Grok 3 Mini Beta
65.1
Full benchmark table
BenchmarkGrok-3 miniGrok 3 Mini Beta
Aider polyglot
Aider Polyglot · measures how well AI models can edit code across multiple programming languages using the Aider coding assistant framework.
49.349.3
HELM · GPQA
67.567.5
HELM · IFEval
95.195.1
HELM · MMLU-Pro
79.979.9
HELM · Omni-MATH
31.831.8
HELM · WildBench
65.165.1
Pricing · per 1M tokens · projected $/mo at 10M tokens
ModelInputOutputContextProjected $/mo
xAI logoGrok-3 mini————
xAI logoGrok 3 Mini Beta$0.30$0.50131K tokens (~66 books)$3.50