Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Input Price

Input token price per 1M tokens.

Input Price measures the listed cost of sending prompts and context to a model. It matters most for retrieval, agent, and long-context workflows where input tokens dominate spend.

Test type: Provider input-token price comparison. Lower values rank better.

Coverage

379 models have this metric.

$0.020/M

Current leader: Gemma 4 E4B (Non-reasoning)

Project links

Prices come from the current Artificial Analysis pricing dataset, read from Supabase when configured.

Artificial Analysis model leaderboardArtificial Analysis methodology

Top Input $ Models

Top models ranked by Input $.

Leaderboard

RankModelCreatorValueSpeedBlended Price
#1Gemma 4 E4B (Non-reasoning)Google$0.020/M102.1 tok/s$0.040/M
#2
Gemma 4 E4B (Reasoning)
Google
$0.020/M
103.3 tok/s
$0.040/M
#3Sarvam 30B (high)Sarvam$0.026/Mn/a$0.047/M
#4Granite 3.3 8B (Non-reasoning)IBM$0.030/Mn/a$0.085/M
#5Qwen3.5 4B (Non-reasoning)Alibaba$0.030/M19.3 tok/s$0.060/M
#6Qwen3.5 4B (Reasoning)Alibaba$0.030/M23.8 tok/s$0.060/M
#7Nova MicroAmazon$0.035/M264 tok/s$0.061/M
#8MCHyperNova 60B 2605Multiverse Computing$0.040/M418.1 tok/s$0.065/M
#9NVIDIA Nemotron Nano 9B V2 (Reasoning)NVIDIA$0.040/M234 tok/s$0.070/M
#10Sarvam 105B (high)Sarvam$0.042/Mn/a$0.074/M
#11Llama 3 Instruct 8BMeta$0.045/Mn/a$0.070/M
#12GPT-5 nano (high)OpenAI$0.050/Mn/a$0.138/M
#13GPT-5 nano (medium)OpenAI$0.050/Mn/a$0.138/M
#14GPT-5 nano (minimal)OpenAI$0.050/Mn/a$0.138/M
#15Granite 4.1 8BIBM$0.050/M114.9 tok/s$0.063/M
#16Llama 2 Chat 7BMeta$0.050/Mn/a$0.100/M
#17NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA$0.050/M218 tok/s$0.088/M
#18NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)NVIDIA$0.050/M259.4 tok/s$0.088/M
#19NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA$0.050/M176.5 tok/s$0.086/M
#20Qwen2.5 TurboAlibaba$0.050/Mn/a$0.088/M
#21Gemma 3n E4B InstructGoogle$0.060/Mn/a$0.075/M
#22Granite 4.0 H SmallIBM$0.060/M426 tok/s$0.107/M
#23Nova LiteAmazon$0.060/Mn/a$0.105/M
#24TEHy3-preview (Non-reasoning)Tencent$0.065/M108.8 tok/s$0.107/M
#25TEHy3-preview (Reasoning)Tencent$0.065/M145 tok/s$0.107/M
#26GLM-4.7-Flash (Non-reasoning)Z AI$0.070/Mn/a$0.153/M
#27GLM-4.7-Flash (Reasoning)Z AI$0.070/Mn/a$0.153/M
#28gpt-oss-20b (high)OpenAI$0.070/M185.1 tok/s$0.103/M
#29gpt-oss-20b (low)OpenAI$0.070/M195.1 tok/s$0.109/M
#30Llama 3.1 Instruct 8BMeta$0.075/Mn/a$0.079/M
#31Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA$0.075/M319.3 tok/s$0.131/M
#32Apertus 8B InstructSwiss AI Initiative$0.100/Mn/a$0.125/M
#33Gemini 2.5 Flash-Lite (Non-reasoning)Google$0.100/Mn/a$0.175/M
#34Gemini 2.5 Flash-Lite (Reasoning)Google$0.100/Mn/a$0.175/M
#35Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)Google$0.100/Mn/a$0.175/M
#36Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)Google$0.100/Mn/a$0.175/M
#37Gemma 4 12B (Non-reasoning)Google$0.100/M34.9 tok/s$0.150/M
#38Gemma 4 12B (Reasoning)Google$0.100/M33.8 tok/s$0.150/M
#39GPT-4.1 nanoOpenAI$0.100/Mn/a$0.175/M
#40Ling 2.6 FlashInclusionAI$0.100/M83.2 tok/s$0.150/M
#41MiMo-V2-Flash (Reasoning)Xiaomi$0.100/Mn/a$0.150/M
#42Ministral 3 3BMistral$0.100/M290.8 tok/s$0.100/M
#43Mistral Small 3Mistral$0.100/Mn/a$0.150/M
#44Mistral Small 3.1Mistral$0.100/Mn/a$0.150/M
#45Mistral Small 3.2Mistral$0.100/Mn/a$0.150/M
#46Olmo 3 7B InstructAllen Institute for AI$0.100/Mn/a$0.125/M
#47Qwen3.5 Omni FlashAlibaba$0.100/M246.6 tok/s$0.275/M
#48Step 3.5 FlashStepFun$0.100/Mn/a$0.150/M
#49Step 3.5 Flash 2603StepFun$0.100/Mn/a$0.150/M
#50Phi-4Microsoft$0.125/M41.9 tok/s$0.219/M
#51Gemma 4 26B A4B (Non-reasoning)Google$0.130/M60.5 tok/s$0.198/M
#52Gemma 4 26B A4B (Reasoning)Google$0.130/Mn/a$0.198/M
#53Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research$0.130/M77.4 tok/s$0.198/M
#54Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research$0.130/M89 tok/s$0.198/M
#55Qwen3.5 9B (Reasoning)Alibaba$0.135/M70.5 tok/s$0.151/M
#56TEHy3Tencent$0.136/M72.2 tok/s$0.241/M
#57DeepSeek V4 Flash (Non-reasoning)DeepSeek$0.140/M108.7 tok/s$0.175/M
#58DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek$0.140/Mn/a$0.175/M
#59DeepSeek V4 Flash (Reasoning, Max Effort)DeepSeek$0.140/M106.7 tok/s$0.175/M
#60DeepSeek V4 Flash 0731 (Reasoning, Max Effort)DeepSeek$0.140/Mn/a$0.175/M
#61Gemma 4 31B (Non-reasoning)Google$0.140/M74.4 tok/s$0.205/M
#62Ling-flash-2.0InclusionAI$0.140/Mn/a$0.247/M
#63MiMo-V2.5Xiaomi$0.140/M69.8 tok/s$0.175/M
#64Ring-flash-2.0InclusionAI$0.140/Mn/a$0.247/M
#65GPT-4o miniOpenAI$0.150/Mn/a$0.262/M
#66gpt-oss-120b (high)OpenAI$0.150/M193.7 tok/s$0.262/M
#67gpt-oss-120b (low)OpenAI$0.150/M229.2 tok/s$0.261/M
#68Ministral 3 8BMistral$0.150/M105.6 tok/s$0.150/M
#69Mistral Small (Feb '24)Mistral$0.150/Mn/a$0.262/M
#70Mistral Small 4 (Non-reasoning)Mistral$0.150/M151.7 tok/s$0.262/M
#71Mistral Small 4 (Reasoning)Mistral$0.150/M149.9 tok/s$0.262/M
#72Solar MiniUpstage$0.150/Mn/a$0.150/M
#73Solar Pro 3Upstage$0.150/M14.6 tok/s$0.262/M
#74GLM-4.5-AirZ AI$0.170/Mn/a$0.372/M
#75Llama 4 ScoutMeta$0.180/M83.5 tok/s$0.300/M
#76Qwen3 8B (Non-reasoning)Alibaba$0.180/Mn/a$0.310/M
#77Qwen3 8B (Reasoning)Alibaba$0.180/Mn/a$0.660/M
#78Qwen3 VL 8B (Reasoning)Alibaba$0.180/Mn/a$0.660/M
#79Qwen3 VL 8B InstructAlibaba$0.180/Mn/a$0.310/M
#80GPT-5.4 nano (medium)OpenAI$0.200/Mn/a$0.463/M