Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Input Price

Input token price per 1M tokens.

Input Price measures the listed cost of sending prompts and context to a model. It matters most for retrieval, agent, and long-context workflows where input tokens dominate spend.

Test type: Provider input-token price comparison. Lower values rank better.

Coverage

371 models have this metric.

$0.020/M

Current leader: Gemma 3n E4B Instruct

Project links

Prices come from the current Artificial Analysis pricing dataset, read from Supabase when configured.

Artificial Analysis model leaderboardArtificial Analysis methodology

Top Input $ Models

Top models ranked by Input $.

Leaderboard

RankModelCreatorValueSpeedBlended Price
#1Gemma 3n E4B InstructGoogle$0.020/M49.7 tok/s$0.025/M
#2
Sarvam 30B (high)
Sarvam
$0.026/M
200.7 tok/s
$0.047/M
#3Qwen3.5 4B (Non-reasoning)Alibaba$0.030/M23 tok/s$0.060/M
#4Qwen3.5 4B (Reasoning)Alibaba$0.030/M22.8 tok/s$0.060/M
#5Granite 3.3 8B (Non-reasoning)IBM$0.030/M414.9 tok/s$0.085/M
#6Nova MicroAmazon$0.035/M249.8 tok/s$0.061/M
#7NVIDIA Nemotron Nano 9B V2 (Reasoning)NVIDIA$0.040/M85.9 tok/s$0.070/M
#8MCHyperNova 60B 2605Multiverse Computing$0.040/M350.9 tok/s$0.065/M
#9Sarvam 105B (high)Sarvam$0.042/M115.9 tok/s$0.074/M
#10Llama 3 Instruct 8BMeta$0.045/M79.8 tok/s$0.070/M
#11gpt-oss-20b (high)OpenAI$0.050/M224.5 tok/s$0.088/M
#12NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA$0.050/M99.8 tok/s$0.088/M
#13NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA$0.050/M111.7 tok/s$0.088/M
#14NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA$0.050/M138.9 tok/s$0.086/M
#15Granite 4.1 8BIBM$0.050/M117.8 tok/s$0.063/M
#16GPT-5 nano (minimal)OpenAI$0.050/M168.7 tok/s$0.138/M
#17GPT-5 nano (medium)OpenAI$0.050/M155.7 tok/s$0.138/M
#18GPT-5 nano (high)OpenAI$0.050/M154.5 tok/s$0.138/M
#19Llama 2 Chat 7BMeta$0.050/M95.6 tok/s$0.100/M
#20Qwen2.5 TurboAlibaba$0.050/M113.6 tok/s$0.088/M
#21gpt-oss-20b (low)OpenAI$0.060/M260.9 tok/s$0.095/M
#22Granite 4.0 H SmallIBM$0.060/M439.5 tok/s$0.107/M
#23Nova LiteAmazon$0.060/M147.8 tok/s$0.105/M
#24GLM-4.7-Flash (Reasoning)Z AI$0.070/M83.7 tok/s$0.153/M
#25GLM-4.7-Flash (Non-reasoning)Z AI$0.070/M122.7 tok/s$0.153/M
#26Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA$0.075/M320 tok/s$0.131/M
#27Gemma 4 12B (Non-reasoning)Google$0.100/M121.2 tok/s$0.150/M
#28Gemma 4 12B (Reasoning)Google$0.100/M125.3 tok/s$0.150/M
#29Ministral 3 3BMistral$0.100/M158.5 tok/s$0.100/M
#30Step 3.5 Flash 2603StepFun$0.100/M256.9 tok/s$0.150/M
#31Olmo 3 7B InstructAllen Institute for AI$0.100/Mn/a$0.125/M
#32Apertus 8B InstructSwiss AI Initiative$0.100/Mn/a$0.125/M
#33Qwen3.5 9B (Reasoning)Alibaba$0.100/M67.6 tok/s$0.113/M
#34Qwen3.5 Omni FlashAlibaba$0.100/M227.8 tok/s$0.275/M
#35Ling 2.6 FlashInclusionAI$0.100/M172.8 tok/s$0.150/M
#36GPT-4.1 nanoOpenAI$0.100/M148 tok/s$0.175/M
#37Llama 3.1 Instruct 8BMeta$0.100/M155.5 tok/s$0.100/M
#38Llama 3.2 Instruct 1BMeta$0.100/M86.4 tok/s$0.100/M
#39Gemini 2.5 Flash-Lite (Reasoning)Google$0.100/M237.8 tok/s$0.175/M
#40Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)Google$0.100/Mn/a$0.175/M
#41Gemini 2.5 Flash-Lite (Non-reasoning)Google$0.100/M182.3 tok/s$0.175/M
#42Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)Google$0.100/Mn/a$0.175/M
#43Mistral Small 3Mistral$0.100/M145.3 tok/s$0.150/M
#44Mistral Small 3.1Mistral$0.100/M144.9 tok/s$0.150/M
#45Mistral Small 3.2Mistral$0.100/M144.9 tok/s$0.150/M
#46Devstral Small (Jul '25)Mistral$0.100/Mn/a$0.150/M
#47Step 3.5 FlashStepFun$0.100/M247.4 tok/s$0.150/M
#48MiMo-V2-Flash (Reasoning)Xiaomi$0.100/Mn/a$0.150/M
#49TEHy3-preview (Reasoning)Tencent$0.123/M124.1 tok/s$0.200/M
#50TEHy3-preview (Non-reasoning)Tencent$0.123/M121.5 tok/s$0.200/M
#51Phi-4Microsoft$0.125/M27 tok/s$0.219/M
#52Gemma 4 26B A4B (Non-reasoning)Google$0.130/M70.8 tok/s$0.198/M
#53Gemma 4 26B A4B (Reasoning)Google$0.130/Mn/a$0.198/M
#54Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research$0.130/M96.2 tok/s$0.198/M
#55Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research$0.130/M92.1 tok/s$0.198/M
#56Gemma 4 31B (Non-reasoning)Google$0.140/M43.7 tok/s$0.205/M
#57DeepSeek V4 Flash (Reasoning, Max Effort)DeepSeek$0.140/M101.1 tok/s$0.175/M
#58DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek$0.140/Mn/a$0.175/M
#59DeepSeek V4 Flash (Non-reasoning)DeepSeek$0.140/M90.1 tok/s$0.175/M
#60MiMo-V2.5Xiaomi$0.140/M75.5 tok/s$0.175/M
#61Ring-flash-2.0InclusionAI$0.140/Mn/a$0.247/M
#62Ling-flash-2.0InclusionAI$0.140/M61.8 tok/s$0.247/M
#63gpt-oss-120b (high)OpenAI$0.150/M231.3 tok/s$0.262/M
#64gpt-oss-120b (low)OpenAI$0.150/M296.3 tok/s$0.262/M
#65Mistral Small 4 (Non-reasoning)Mistral$0.150/M142.1 tok/s$0.262/M
#66Ministral 3 8BMistral$0.150/M89 tok/s$0.150/M
#67Mistral Small 4 (Reasoning)Mistral$0.150/M166.7 tok/s$0.262/M
#68GPT-4o miniOpenAI$0.150/M73.5 tok/s$0.262/M
#69Llama 3.2 Instruct 3BMeta$0.150/M51.7 tok/s$0.150/M
#70Gemini 2.0 Flash (Feb '25)Google$0.150/Mn/a$0.262/M
#71Solar MiniUpstage$0.150/M78.2 tok/s$0.150/M
#72GLM-4.5-AirZ AI$0.170/M78.8 tok/s$0.372/M
#73Llama 4 ScoutMeta$0.175/M89.6 tok/s$0.287/M
#74Qwen3 8B (Non-reasoning)Alibaba$0.180/M65.2 tok/s$0.310/M
#75Qwen3 8B (Reasoning)Alibaba$0.180/M64.5 tok/s$0.660/M
#76Qwen3 VL 8B InstructAlibaba$0.180/M135.8 tok/s$0.310/M
#77Qwen3 VL 8B (Reasoning)Alibaba$0.180/M130.1 tok/s$0.660/M
#78GPT-5.4 nano (medium)OpenAI$0.200/M155.9 tok/s$0.463/M
#79GPT-5.4 nano (xhigh)OpenAI$0.200/M161.4 tok/s$0.463/M
#80GPT-5.4 nano (Non-Reasoning)OpenAI$0.200/M170.4 tok/s$0.463/M