Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Math

Math leaderboard from math-specific benchmark metrics.

Leader

Domain score averages relative percentile across included metrics.

GPT-5.6 Sol (max)

Domain score 100

MathLiveBench MathMATH-500AIME

Top Math Models

Math leaderboard from math-specific benchmark metrics.

Domain Leaderboard

RankModelCreatorDomain ScoreSpeedBlended Price
#1GPT-5.6 Sol (max)OpenAI100.067.4 tok/s$11.25/M
#2
GPT-5.2 (xhigh)
OpenAI
100.0
80.5 tok/s
$4.81/M
#3GPT-5 Codex (high)OpenAI99.6167.4 tok/s$3.44/M
#4Gemini 3 Flash Preview (Reasoning)Google99.3197.7 tok/s$1.13/M
#5GPT-5.2 (medium)OpenAI98.9n/a$4.81/M
#6GPT-5 (high)OpenAI98.5102.7 tok/s$3.44/M
#7DeepSeek V3.2 SpecialeDeepSeek98.5n/a-
#8MiMo-V2-Flash (Reasoning)Xiaomi98.1n/a$0.150/M
#9GPT-5.1 Codex (high)OpenAI97.8173.3 tok/s$3.44/M
#10Gemini 3 Pro Preview (high)Google97.4n/a$4.50/M
#11Grok 4SpaceXAI97.1n/a$11.00/M
#12GLM-4.7 (Reasoning)Z AI97.0101.5 tok/s$1.00/M
#13KAT-Coder-Pro V1KwaiKAT96.6n/a-
#14GPT-5 (medium)OpenAI96.591.5 tok/s$3.44/M
#15Kimi K2 ThinkingKimi96.3131 tok/s$1.08/M
#16Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)Anthropic96.069.4 tok/s$20.00/M
#17o4-mini (high)OpenAI95.9162.3 tok/s$1.93/M
#18Nova 2.0 Lite (high)Amazon95.9182.5 tok/s$0.850/M
#19Qwen3 235B A22B 2507 (Reasoning)Alibaba95.258.3 tok/s$2.63/M
#20GPT-5.1 (high)OpenAI95.189.9 tok/s$3.44/M
#21gpt-oss-120b (high)OpenAI94.8231.3 tok/s$0.262/M
#22o3OpenAI94.4116.6 tok/s$3.50/M
#23o3-mini (high)OpenAI94.4221.6 tok/s$1.93/M
#24DeepSeek V3.2 (Reasoning)DeepSeek94.0n/a$0.315/M
#25Gemini 2.5 Pro Preview (May' 25)Google93.6n/a$3.44/M
#26GPT-5.1 Codex mini (high)OpenAI93.3203.4 tok/s$0.688/M
#27Gemini 2.5 Pro Preview (Mar' 25)Google93.2n/a-
#28Grok 3 mini Reasoning (high)SpaceXAI93.145.7 tok/s$0.350/M
#29Claude Opus 4.5 (Reasoning)Anthropic92.958.5 tok/s$10.00/M
#30NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA92.5111.7 tok/s$0.088/M
#31Gemini 2.5 Flash Preview (Reasoning)Google92.1n/a-
#32GPT-5.5 (xhigh)OpenAI92.073.9 tok/s$11.25/M
#33GPT-5 mini (high)OpenAI91.496.9 tok/s$0.688/M
#34K-EXAONE (Reasoning)LG AI Research91.0n/a-
#35Nova 2.0 Omni (medium)Amazon90.7n/a$0.850/M
#36DeepSeek V3.1 Terminus (Reasoning)DeepSeek90.3n/a$1.91/M
#37DeepSeek V3.1 (Reasoning)DeepSeek89.9n/a$0.865/M
#38Grok 4 Fast (Reasoning)SpaceXAI89.6n/a$0.275/M
#39gpt-oss-20b (high)OpenAI89.2224.5 tok/s$0.088/M
#40Gemini 2.5 ProGoogle88.9127.9 tok/s$3.44/M
#41GPT-5 (low)OpenAI88.883.9 tok/s$3.44/M
#42Grok 4.1 Fast (Reasoning)SpaceXAI88.8n/a-
#43Ring-1TInclusionAI88.4n/a-
#44Nova 2.0 Pro Preview (medium)Amazon88.1129.7 tok/s$3.44/M
#45GPT-5.6 Sol (xhigh)OpenAI88.057 tok/s$11.25/M
#46Nova 2.0 Lite (medium)Amazon87.7176.8 tok/s$0.850/M
#47o3-miniOpenAI87.5210.5 tok/s$1.93/M
#48DeepSeek R1 0528 (May '25)DeepSeek87.0n/a$2.06/M
#49Qwen3 VL 235B A22B (Reasoning)Alibaba86.958.3 tok/s$2.63/M
#50Llama Nemotron Super 49B v1.5 (Reasoning)NVIDIA86.851.8 tok/s$0.400/M
#51INTELLECT-3Prime Intellect86.6n/a-
#52Apriel-v1.6-15B-ThinkerServiceNow86.2n/a-
#53Claude 4.5 Sonnet (Reasoning)Anthropic85.850 tok/s$6.00/M
#54EXAONE 4.0 32B (Reasoning)LG AI Research85.7n/a-
#55DeepSeek V3.2 Exp (Reasoning)DeepSeek85.1n/a$0.315/M
#56Claude 4 Sonnet (Reasoning)Anthropic85.1n/a$6.00/M
#57Sonar Reasoning ProPerplexity84.8n/a-
#58GLM-4.5 (Reasoning)Z AI84.8n/a-
#59Apriel-v1.5-15B-ThinkerServiceNow84.7n/a-
#60o1OpenAI84.7131.8 tok/s$26.25/M
#61Gemini 3 Pro Preview (low)Google84.3n/a$4.50/M
#62Claude Opus 4.8 (Adaptive Reasoning, Max Effort)Anthropic84.054.3 tok/s$10.00/M
#63GLM-4.6 (Reasoning)Z AI84.036.9 tok/s$0.963/M
#64Gemini 2.5 Flash (Reasoning)Google83.8219.1 tok/s$0.850/M
#65GLM-4.6V (Reasoning)Z AI83.639.8 tok/s$0.450/M
#66ERNIE 5.0 Thinking PreviewBaidu83.2n/a-
#67GPT-5 mini (medium)OpenAI82.892.8 tok/s$0.688/M
#68Claude 4 Opus (Reasoning)Anthropic82.3n/a$30.00/M
#69Qwen3 VL 32B (Reasoning)Alibaba82.195.5 tok/s$2.63/M
#70Seed-OSS-36B-InstructByteDance Seed81.736.6 tok/s$0.300/M
#71Qwen3 Next 80B A3B (Reasoning)Alibaba81.3174.8 tok/s$1.88/M
#72Claude 4.5 Haiku (Reasoning)Anthropic81.0117.9 tok/s$2.00/M
#73Ring-flash-2.0InclusionAI80.6n/a$0.247/M
#74R1 1776Perplexity80.5n/a-
#75MiniMax M1 80kMiniMax80.4n/a$0.963/M
#76GPT-5 nano (high)OpenAI80.2154.5 tok/s$0.138/M
#77GPT-5.5 (high)OpenAI80.058.4 tok/s$11.25/M
#78Qwen3 30B A3B 2507 (Reasoning)Alibaba79.8143.8 tok/s$0.750/M
#79Qwen3 235B A22B (Reasoning)Alibaba79.864 tok/s$2.63/M
#80Qwen3 32B (Reasoning)Alibaba79.7100.9 tok/s$2.63/M