Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Blended Price

Price per 1M tokens using the Artificial Analysis 3:1 blended ratio.

Blended Price is a cost metric for comparing providers with different input and output token prices. Artificial Analysis calculates it with a 3:1 input-to-output token ratio so a single number can summarize typical API cost.

Test type: Provider price normalization. Lower values rank better.

Coverage

371 models have this metric.

$0.025/M

Current leader: Gemma 3n E4B Instruct

Project links

Prices come from the current Artificial Analysis pricing dataset, read from Supabase when configured.

Artificial Analysis model leaderboardArtificial Analysis methodology

Top Blended $ Models

Top models ranked by Blended $.

Leaderboard

RankModelCreatorValueSpeedBlended Price
#1Gemma 3n E4B InstructGoogle$0.025/M49.7 tok/s$0.025/M
#2
Sarvam 30B (high)
Sarvam
$0.047/M
200.7 tok/s
$0.047/M
#3Qwen3.5 4B (Non-reasoning)Alibaba$0.060/M23 tok/s$0.060/M
#4Qwen3.5 4B (Reasoning)Alibaba$0.060/M22.8 tok/s$0.060/M
#5Nova MicroAmazon$0.061/M249.8 tok/s$0.061/M
#6Granite 4.1 8BIBM$0.063/M117.8 tok/s$0.063/M
#7MCHyperNova 60B 2605Multiverse Computing$0.065/M350.9 tok/s$0.065/M
#8NVIDIA Nemotron Nano 9B V2 (Reasoning)NVIDIA$0.070/M85.9 tok/s$0.070/M
#9Llama 3 Instruct 8BMeta$0.070/M79.8 tok/s$0.070/M
#10Sarvam 105B (high)Sarvam$0.074/M115.9 tok/s$0.074/M
#11Granite 3.3 8B (Non-reasoning)IBM$0.085/M414.9 tok/s$0.085/M
#12NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA$0.086/M138.9 tok/s$0.086/M
#13gpt-oss-20b (high)OpenAI$0.088/M224.5 tok/s$0.088/M
#14NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA$0.088/M99.8 tok/s$0.088/M
#15NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA$0.088/M111.7 tok/s$0.088/M
#16Qwen2.5 TurboAlibaba$0.088/M113.6 tok/s$0.088/M
#17gpt-oss-20b (low)OpenAI$0.095/M260.9 tok/s$0.095/M
#18Ministral 3 3BMistral$0.100/M158.5 tok/s$0.100/M
#19Llama 3.1 Instruct 8BMeta$0.100/M155.5 tok/s$0.100/M
#20Llama 3.2 Instruct 1BMeta$0.100/M86.4 tok/s$0.100/M
#21Llama 2 Chat 7BMeta$0.100/M95.6 tok/s$0.100/M
#22Nova LiteAmazon$0.105/M147.8 tok/s$0.105/M
#23Granite 4.0 H SmallIBM$0.107/M439.5 tok/s$0.107/M
#24Qwen3.5 9B (Reasoning)Alibaba$0.113/M67.6 tok/s$0.113/M
#25Olmo 3 7B InstructAllen Institute for AI$0.125/Mn/a$0.125/M
#26Apertus 8B InstructSwiss AI Initiative$0.125/Mn/a$0.125/M
#27Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA$0.131/M320 tok/s$0.131/M
#28GPT-5 nano (minimal)OpenAI$0.138/M168.7 tok/s$0.138/M
#29GPT-5 nano (medium)OpenAI$0.138/M155.7 tok/s$0.138/M
#30GPT-5 nano (high)OpenAI$0.138/M154.5 tok/s$0.138/M
#31Gemma 4 12B (Non-reasoning)Google$0.150/M121.2 tok/s$0.150/M
#32Gemma 4 12B (Reasoning)Google$0.150/M125.3 tok/s$0.150/M
#33Ministral 3 8BMistral$0.150/M89 tok/s$0.150/M
#34Step 3.5 Flash 2603StepFun$0.150/M256.9 tok/s$0.150/M
#35Ling 2.6 FlashInclusionAI$0.150/M172.8 tok/s$0.150/M
#36Llama 3.2 Instruct 3BMeta$0.150/M51.7 tok/s$0.150/M
#37Mistral Small 3Mistral$0.150/M145.3 tok/s$0.150/M
#38Mistral Small 3.1Mistral$0.150/M144.9 tok/s$0.150/M
#39Mistral Small 3.2Mistral$0.150/M144.9 tok/s$0.150/M
#40Devstral Small (Jul '25)Mistral$0.150/Mn/a$0.150/M
#41Solar MiniUpstage$0.150/M78.2 tok/s$0.150/M
#42Step 3.5 FlashStepFun$0.150/M247.4 tok/s$0.150/M
#43MiMo-V2-Flash (Reasoning)Xiaomi$0.150/Mn/a$0.150/M
#44GLM-4.7-Flash (Reasoning)Z AI$0.153/M83.7 tok/s$0.153/M
#45GLM-4.7-Flash (Non-reasoning)Z AI$0.153/M122.7 tok/s$0.153/M
#46DeepSeek V4 Flash (Reasoning, Max Effort)DeepSeek$0.175/M101.1 tok/s$0.175/M
#47DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek$0.175/Mn/a$0.175/M
#48DeepSeek V4 Flash (Non-reasoning)DeepSeek$0.175/M90.1 tok/s$0.175/M
#49MiMo-V2.5Xiaomi$0.175/M75.5 tok/s$0.175/M
#50GPT-4.1 nanoOpenAI$0.175/M148 tok/s$0.175/M
#51Gemini 2.5 Flash-Lite (Reasoning)Google$0.175/M237.8 tok/s$0.175/M
#52Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)Google$0.175/Mn/a$0.175/M
#53Gemini 2.5 Flash-Lite (Non-reasoning)Google$0.175/M182.3 tok/s$0.175/M
#54Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)Google$0.175/Mn/a$0.175/M
#55Gemma 4 26B A4B (Non-reasoning)Google$0.198/M70.8 tok/s$0.198/M
#56Gemma 4 26B A4B (Reasoning)Google$0.198/Mn/a$0.198/M
#57Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research$0.198/M96.2 tok/s$0.198/M
#58Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research$0.198/M92.1 tok/s$0.198/M
#59Ministral 3 14BMistral$0.200/M75.5 tok/s$0.200/M
#60TEHy3-preview (Reasoning)Tencent$0.200/M124.1 tok/s$0.200/M
#61TEHy3-preview (Non-reasoning)Tencent$0.200/M121.5 tok/s$0.200/M
#62Gemma 4 31B (Non-reasoning)Google$0.205/M43.7 tok/s$0.205/M
#63Phi-4Microsoft$0.219/M27 tok/s$0.219/M
#64Ring-flash-2.0InclusionAI$0.247/Mn/a$0.247/M
#65Ling-flash-2.0InclusionAI$0.247/M61.8 tok/s$0.247/M
#66Mistral 7B InstructMistral$0.250/M91.5 tok/s$0.250/M
#67Jamba 1.5 MiniAI21 Labs$0.250/Mn/a$0.250/M
#68Jamba 1.6 MiniAI21 Labs$0.250/M179.6 tok/s$0.250/M
#69gpt-oss-120b (high)OpenAI$0.262/M231.3 tok/s$0.262/M
#70gpt-oss-120b (low)OpenAI$0.262/M296.3 tok/s$0.262/M
#71Mistral Small 4 (Non-reasoning)Mistral$0.262/M142.1 tok/s$0.262/M
#72Mistral Small 4 (Reasoning)Mistral$0.262/M166.7 tok/s$0.262/M
#73GPT-4o miniOpenAI$0.262/M73.5 tok/s$0.262/M
#74Gemini 2.0 Flash (Feb '25)Google$0.262/Mn/a$0.262/M
#75Qwen3.5 Omni FlashAlibaba$0.275/M227.8 tok/s$0.275/M
#76Grok 4 Fast (Reasoning)SpaceXAI$0.275/Mn/a$0.275/M
#77Grok 4 Fast (Non-reasoning)SpaceXAI$0.275/Mn/a$0.275/M
#78Llama 4 ScoutMeta$0.287/M89.6 tok/s$0.287/M
#79NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)NVIDIA$0.300/M224.5 tok/s$0.300/M
#80NVIDIA Nemotron Nano 12B v2 VL (Reasoning)NVIDIA$0.300/M282.5 tok/s$0.300/M