Input token price per 1M tokens.
Input Price measures the listed cost of sending prompts and context to a model. It matters most for retrieval, agent, and long-context workflows where input tokens dominate spend.
Test type: Provider input-token price comparison. Lower values rank better.
371 models have this metric.
Current leader: Gemma 3n E4B Instruct
Project links
Prices come from the current Artificial Analysis pricing dataset, read from Supabase when configured.
Top models ranked by Input $.
| Rank | Model | Creator | Value | Speed | Blended Price |
|---|---|---|---|---|---|
| #1 | Gemma 3n E4B Instruct | $0.020/M | 49.7 tok/s | $0.025/M | |
| #2 |
| Sarvam |
| $0.026/M |
| 200.7 tok/s |
| $0.047/M |
| #3 | Qwen3.5 4B (Non-reasoning) | Alibaba | $0.030/M | 23 tok/s | $0.060/M |
| #4 | Qwen3.5 4B (Reasoning) | Alibaba | $0.030/M | 22.8 tok/s | $0.060/M |
| #5 | Granite 3.3 8B (Non-reasoning) | IBM | $0.030/M | 414.9 tok/s | $0.085/M |
| #6 | Nova Micro | Amazon | $0.035/M | 249.8 tok/s | $0.061/M |
| #7 | NVIDIA Nemotron Nano 9B V2 (Reasoning) | NVIDIA | $0.040/M | 85.9 tok/s | $0.070/M |
| #8 | HyperNova 60B 2605 | Multiverse Computing | $0.040/M | 350.9 tok/s | $0.065/M |
| #9 | Sarvam 105B (high) | Sarvam | $0.042/M | 115.9 tok/s | $0.074/M |
| #10 | Llama 3 Instruct 8B | Meta | $0.045/M | 79.8 tok/s | $0.070/M |
| #11 | gpt-oss-20b (high) | OpenAI | $0.050/M | 224.5 tok/s | $0.088/M |
| #12 | NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning) | NVIDIA | $0.050/M | 99.8 tok/s | $0.088/M |
| #13 | NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) | NVIDIA | $0.050/M | 111.7 tok/s | $0.088/M |
| #14 | NVIDIA Nemotron Nano 9B V2 (Non-reasoning) | NVIDIA | $0.050/M | 138.9 tok/s | $0.086/M |
| #15 | Granite 4.1 8B | IBM | $0.050/M | 117.8 tok/s | $0.063/M |
| #16 | GPT-5 nano (minimal) | OpenAI | $0.050/M | 168.7 tok/s | $0.138/M |
| #17 | GPT-5 nano (medium) | OpenAI | $0.050/M | 155.7 tok/s | $0.138/M |
| #18 | GPT-5 nano (high) | OpenAI | $0.050/M | 154.5 tok/s | $0.138/M |
| #19 | Llama 2 Chat 7B | Meta | $0.050/M | 95.6 tok/s | $0.100/M |
| #20 | Qwen2.5 Turbo | Alibaba | $0.050/M | 113.6 tok/s | $0.088/M |
| #21 | gpt-oss-20b (low) | OpenAI | $0.060/M | 260.9 tok/s | $0.095/M |
| #22 | Granite 4.0 H Small | IBM | $0.060/M | 439.5 tok/s | $0.107/M |
| #23 | Nova Lite | Amazon | $0.060/M | 147.8 tok/s | $0.105/M |
| #24 | GLM-4.7-Flash (Reasoning) | Z AI | $0.070/M | 83.7 tok/s | $0.153/M |
| #25 | GLM-4.7-Flash (Non-reasoning) | Z AI | $0.070/M | 122.7 tok/s | $0.153/M |
| #26 | Nemotron 3 Nano Omni 30B A3B Reasoning | NVIDIA | $0.075/M | 320 tok/s | $0.131/M |
| #27 | Gemma 4 12B (Non-reasoning) | $0.100/M | 121.2 tok/s | $0.150/M |
| #28 | Gemma 4 12B (Reasoning) | $0.100/M | 125.3 tok/s | $0.150/M |
| #29 | Ministral 3 3B | Mistral | $0.100/M | 158.5 tok/s | $0.100/M |
| #30 | Step 3.5 Flash 2603 | StepFun | $0.100/M | 256.9 tok/s | $0.150/M |
| #31 | Olmo 3 7B Instruct | Allen Institute for AI | $0.100/M | n/a | $0.125/M |
| #32 | Apertus 8B Instruct | Swiss AI Initiative | $0.100/M | n/a | $0.125/M |
| #33 | Qwen3.5 9B (Reasoning) | Alibaba | $0.100/M | 67.6 tok/s | $0.113/M |
| #34 | Qwen3.5 Omni Flash | Alibaba | $0.100/M | 227.8 tok/s | $0.275/M |
| #35 | Ling 2.6 Flash | InclusionAI | $0.100/M | 172.8 tok/s | $0.150/M |
| #36 | GPT-4.1 nano | OpenAI | $0.100/M | 148 tok/s | $0.175/M |
| #37 | Llama 3.1 Instruct 8B | Meta | $0.100/M | 155.5 tok/s | $0.100/M |
| #38 | Llama 3.2 Instruct 1B | Meta | $0.100/M | 86.4 tok/s | $0.100/M |
| #39 | Gemini 2.5 Flash-Lite (Reasoning) | $0.100/M | 237.8 tok/s | $0.175/M |
| #40 | Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning) | $0.100/M | n/a | $0.175/M |
| #41 | Gemini 2.5 Flash-Lite (Non-reasoning) | $0.100/M | 182.3 tok/s | $0.175/M |
| #42 | Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning) | $0.100/M | n/a | $0.175/M |
| #43 | Mistral Small 3 | Mistral | $0.100/M | 145.3 tok/s | $0.150/M |
| #44 | Mistral Small 3.1 | Mistral | $0.100/M | 144.9 tok/s | $0.150/M |
| #45 | Mistral Small 3.2 | Mistral | $0.100/M | 144.9 tok/s | $0.150/M |
| #46 | Devstral Small (Jul '25) | Mistral | $0.100/M | n/a | $0.150/M |
| #47 | Step 3.5 Flash | StepFun | $0.100/M | 247.4 tok/s | $0.150/M |
| #48 | MiMo-V2-Flash (Reasoning) | Xiaomi | $0.100/M | n/a | $0.150/M |
| #49 | Hy3-preview (Reasoning) | Tencent | $0.123/M | 124.1 tok/s | $0.200/M |
| #50 | Hy3-preview (Non-reasoning) | Tencent | $0.123/M | 121.5 tok/s | $0.200/M |
| #51 | Phi-4 | Microsoft | $0.125/M | 27 tok/s | $0.219/M |
| #52 | Gemma 4 26B A4B (Non-reasoning) | $0.130/M | 70.8 tok/s | $0.198/M |
| #53 | Gemma 4 26B A4B (Reasoning) | $0.130/M | n/a | $0.198/M |
| #54 | Hermes 4 - Llama-3.1 70B (Non-reasoning) | Nous Research | $0.130/M | 96.2 tok/s | $0.198/M |
| #55 | Hermes 4 - Llama-3.1 70B (Reasoning) | Nous Research | $0.130/M | 92.1 tok/s | $0.198/M |
| #56 | Gemma 4 31B (Non-reasoning) | $0.140/M | 43.7 tok/s | $0.205/M |
| #57 | DeepSeek V4 Flash (Reasoning, Max Effort) | DeepSeek | $0.140/M | 101.1 tok/s | $0.175/M |
| #58 | DeepSeek V4 Flash (Reasoning, High Effort) | DeepSeek | $0.140/M | n/a | $0.175/M |
| #59 | DeepSeek V4 Flash (Non-reasoning) | DeepSeek | $0.140/M | 90.1 tok/s | $0.175/M |
| #60 | MiMo-V2.5 | Xiaomi | $0.140/M | 75.5 tok/s | $0.175/M |
| #61 | Ring-flash-2.0 | InclusionAI | $0.140/M | n/a | $0.247/M |
| #62 | Ling-flash-2.0 | InclusionAI | $0.140/M | 61.8 tok/s | $0.247/M |
| #63 | gpt-oss-120b (high) | OpenAI | $0.150/M | 231.3 tok/s | $0.262/M |
| #64 | gpt-oss-120b (low) | OpenAI | $0.150/M | 296.3 tok/s | $0.262/M |
| #65 | Mistral Small 4 (Non-reasoning) | Mistral | $0.150/M | 142.1 tok/s | $0.262/M |
| #66 | Ministral 3 8B | Mistral | $0.150/M | 89 tok/s | $0.150/M |
| #67 | Mistral Small 4 (Reasoning) | Mistral | $0.150/M | 166.7 tok/s | $0.262/M |
| #68 | GPT-4o mini | OpenAI | $0.150/M | 73.5 tok/s | $0.262/M |
| #69 | Llama 3.2 Instruct 3B | Meta | $0.150/M | 51.7 tok/s | $0.150/M |
| #70 | Gemini 2.0 Flash (Feb '25) | $0.150/M | n/a | $0.262/M |
| #71 | Solar Mini | Upstage | $0.150/M | 78.2 tok/s | $0.150/M |
| #72 | GLM-4.5-Air | Z AI | $0.170/M | 78.8 tok/s | $0.372/M |
| #73 | Llama 4 Scout | Meta | $0.175/M | 89.6 tok/s | $0.287/M |
| #74 | Qwen3 8B (Non-reasoning) | Alibaba | $0.180/M | 65.2 tok/s | $0.310/M |
| #75 | Qwen3 8B (Reasoning) | Alibaba | $0.180/M | 64.5 tok/s | $0.660/M |
| #76 | Qwen3 VL 8B Instruct | Alibaba | $0.180/M | 135.8 tok/s | $0.310/M |
| #77 | Qwen3 VL 8B (Reasoning) | Alibaba | $0.180/M | 130.1 tok/s | $0.660/M |
| #78 | GPT-5.4 nano (medium) | OpenAI | $0.200/M | 155.9 tok/s | $0.463/M |
| #79 | GPT-5.4 nano (xhigh) | OpenAI | $0.200/M | 161.4 tok/s | $0.463/M |
| #80 | GPT-5.4 nano (Non-Reasoning) | OpenAI | $0.200/M | 170.4 tok/s | $0.463/M |