Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Price & Value

Cost leaderboard using input, output, blended price, and value index.

Leader

Domain score averages relative percentile across included metrics.

Qwen3.5 4B (Non-reasoning)

Domain score 99

Blended $Input $Output $Value

Top Cost Models

Cost leaderboard using input, output, blended price, and value index.

Domain Leaderboard

RankModelCreatorDomain ScoreSpeedBlended Price
#1Qwen3.5 4B (Non-reasoning)Alibaba98.923 tok/s$0.060/M
#2
Qwen3.5 4B (Reasoning)
Alibaba
98.8
22.8 tok/s
$0.060/M
#3MCHyperNova 60B 2605Multiverse Computing98.6350.9 tok/s$0.065/M
#4Sarvam 30B (high)Sarvam98.2200.7 tok/s$0.047/M
#5Granite 4.1 8BIBM96.9117.8 tok/s$0.063/M
#6Sarvam 105B (high)Sarvam96.8115.9 tok/s$0.074/M
#7gpt-oss-20b (high)OpenAI96.6224.5 tok/s$0.088/M
#8NVIDIA Nemotron Nano 9B V2 (Reasoning)NVIDIA96.585.9 tok/s$0.070/M
#9Nova MicroAmazon96.0249.8 tok/s$0.061/M
#10NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA95.9111.7 tok/s$0.088/M
#11gpt-oss-20b (low)OpenAI95.3260.9 tok/s$0.095/M
#12Qwen3.5 9B (Reasoning)Alibaba95.167.6 tok/s$0.113/M
#13NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA94.8138.9 tok/s$0.086/M
#14Gemma 3n E4B InstructGoogle94.649.7 tok/s$0.025/M
#15NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA94.499.8 tok/s$0.088/M
#16Ministral 3 3BMistral93.2158.5 tok/s$0.100/M
#17Llama 3.1 Instruct 8BMeta93.1155.5 tok/s$0.100/M
#18Step 3.5 Flash 2603StepFun92.7256.9 tok/s$0.150/M
#19Qwen2.5 TurboAlibaba92.6113.6 tok/s$0.088/M
#20Gemma 4 12B (Reasoning)Google92.5125.3 tok/s$0.150/M
#21Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA92.4320 tok/s$0.131/M
#22GPT-5 nano (medium)OpenAI91.9155.7 tok/s$0.138/M
#23GPT-5 nano (high)OpenAI91.8154.5 tok/s$0.138/M
#24Gemma 4 12B (Non-reasoning)Google91.5121.2 tok/s$0.150/M
#25Nova LiteAmazon91.4147.8 tok/s$0.105/M
#26DeepSeek V4 Flash (Reasoning, Max Effort)DeepSeek90.9101.1 tok/s$0.175/M
#27DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek90.6n/a$0.175/M
#28Ling 2.6 FlashInclusionAI90.6172.8 tok/s$0.150/M
#29MiMo-V2-Flash (Reasoning)Xiaomi90.5n/a$0.150/M
#30Step 3.5 FlashStepFun90.5247.4 tok/s$0.150/M
#31GLM-4.7-Flash (Reasoning)Z AI90.383.7 tok/s$0.153/M
#32MiMo-V2.5Xiaomi90.175.5 tok/s$0.175/M
#33Granite 4.0 H SmallIBM89.9439.5 tok/s$0.107/M
#34DeepSeek V4 Flash (Non-reasoning)DeepSeek89.990.1 tok/s$0.175/M
#35Mistral Small 3.1Mistral89.7144.9 tok/s$0.150/M
#36Llama 2 Chat 7BMeta89.595.6 tok/s$0.100/M
#37GLM-4.7-Flash (Non-reasoning)Z AI89.2122.7 tok/s$0.153/M
#38GPT-5 nano (minimal)OpenAI88.7168.7 tok/s$0.138/M
#39Ministral 3 8BMistral88.389 tok/s$0.150/M
#40Mistral Small 3.2Mistral88.2144.9 tok/s$0.150/M
#41Gemma 4 26B A4B (Reasoning)Google88.0n/a$0.198/M
#42Gemma 4 26B A4B (Non-reasoning)Google87.870.8 tok/s$0.198/M
#43Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)Google87.6n/a$0.175/M
#44TEHy3-preview (Reasoning)Tencent87.3124.1 tok/s$0.200/M
#45Gemma 4 31B (Non-reasoning)Google87.243.7 tok/s$0.205/M
#46Devstral Small (Jul '25)Mistral87.0n/a$0.150/M
#47TEHy3-preview (Non-reasoning)Tencent86.4121.5 tok/s$0.200/M
#48Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)Google86.3n/a$0.175/M
#49Mistral Small 3Mistral86.3145.3 tok/s$0.150/M
#50Granite 3.3 8B (Non-reasoning)IBM86.2414.9 tok/s$0.085/M
#51Gemini 2.5 Flash-Lite (Reasoning)Google86.1237.8 tok/s$0.175/M
#52Llama 3 Instruct 8BMeta85.979.8 tok/s$0.070/M
#53GPT-4.1 nanoOpenAI85.5148 tok/s$0.175/M
#54Solar MiniUpstage85.478.2 tok/s$0.150/M
#55Olmo 3 7B InstructAllen Institute for AI84.5n/a$0.125/M
#56Ministral 3 14BMistral84.275.5 tok/s$0.200/M
#57Llama 3.2 Instruct 3BMeta83.851.7 tok/s$0.150/M
#58Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research83.692.1 tok/s$0.198/M
#59gpt-oss-120b (high)OpenAI83.5231.3 tok/s$0.262/M
#60Gemini 2.5 Flash-Lite (Non-reasoning)Google83.3182.3 tok/s$0.175/M
#61Qwen3.5 Omni FlashAlibaba82.5227.8 tok/s$0.275/M
#62Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research82.196.2 tok/s$0.198/M
#63Grok 4 Fast (Reasoning)SpaceXAI82.0n/a$0.275/M
#64Mistral Small 4 (Reasoning)Mistral81.8166.7 tok/s$0.262/M
#65gpt-oss-120b (low)OpenAI80.6296.3 tok/s$0.262/M
#66Llama 3.2 Instruct 1BMeta80.586.4 tok/s$0.100/M
#67DeepSeek V3.2 (Reasoning)DeepSeek80.3n/a$0.315/M
#68Mistral Small 4 (Non-reasoning)Mistral79.8142.1 tok/s$0.262/M
#69Ling-flash-2.0InclusionAI79.861.8 tok/s$0.247/M
#70Grok 4 Fast (Non-reasoning)SpaceXAI79.2n/a$0.275/M
#71Ring-flash-2.0InclusionAI79.1n/a$0.247/M
#72DeepSeek V3.2 (Non-reasoning)DeepSeek79.0n/a$0.315/M
#73Gemini 2.0 Flash (Feb '25)Google78.8n/a$0.262/M
#74DeepSeek V3.2 Exp (Reasoning)DeepSeek78.7n/a$0.315/M
#75Seed-OSS-36B-InstructByteDance Seed78.136.6 tok/s$0.300/M
#76DeepSeek V3.2 Exp (Non-reasoning)DeepSeek78.0n/a$0.315/M
#77Phi-4Microsoft77.227 tok/s$0.219/M
#78Llama 4 ScoutMeta76.889.6 tok/s$0.287/M
#79Apertus 8B InstructSwiss AI Initiative76.7n/a$0.125/M
#80Mercury 2Inception76.3880.1 tok/s$0.375/M