Artificial Analysis aggregate coding score.
The Coding Index is the source dataset's aggregate coding signal. Use it as a broad programming capability view before drilling into individual code benchmarks such as LiveCodeBench and SciCode.
Test type: Aggregate coding evaluation that combines code-focused benchmark results exposed by Artificial Analysis.
222 models have this metric.
Current leader: GPT-5.6 Sol (xhigh)
Project links
Scores come from the current Artificial Analysis dataset, read from Supabase when configured.
Top models ranked by Coding.
| Rank | Model | Creator | Value | Speed | Blended Price |
|---|---|---|---|---|---|
| #1 | GPT-5.6 Sol (xhigh) | OpenAI | 78.3 | 57 tok/s | $11.25/M |
| #2 |
| OpenAI |
| 77.4 |
| 67.4 tok/s |
| $11.25/M |
| #3 | GPT-5.6 Sol (high) | OpenAI | 77.2 | 56.2 tok/s | $11.25/M |
| #4 | GPT-5.6 Terra (max) | OpenAI | 76.7 | 170.1 tok/s | $5.63/M |
| #5 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | Anthropic | 76.5 | 69.4 tok/s | $20.00/M |
| #6 | GPT-5.6 Sol (medium) | OpenAI | 76.3 | 55.6 tok/s | $11.25/M |
| #7 | GPT-5.5 (xhigh) | OpenAI | 74.9 | 73.9 tok/s | $11.25/M |
| #8 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | Anthropic | 74.3 | 54.3 tok/s | $10.00/M |
| #9 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort) | Anthropic | 73.6 | 49.5 tok/s | $10.00/M |
| #10 | Claude Opus 4.7 (Non-reasoning, High Effort) | Anthropic | 73.6 | 43 tok/s | $10.00/M |
| #11 | Grok 4.5 (high) | SpaceXAI | 72.4 | 122.8 tok/s | $3.00/M |
| #12 | GPT-5.5 (high) | OpenAI | 71.6 | 58.4 tok/s | $11.25/M |
| #13 | GPT-5.5 (medium) | OpenAI | 71.5 | 58.3 tok/s | $11.25/M |
| #14 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort) | Anthropic | 71.5 | 89.2 tok/s | $4.00/M |
| #15 | Claude Sonnet 5 (Adaptive Reasoning, Low Effort) | Anthropic | 71.5 | 59.2 tok/s | $4.00/M |
| #16 | Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort) | Anthropic | 71.5 | 69.1 tok/s | $4.00/M |
| #17 | Claude Sonnet 5 (Adaptive Reasoning, High Effort) | Anthropic | 71.5 | 59.1 tok/s | $4.00/M |
| #18 | Claude Sonnet 5 (Adaptive Reasoning, Medium Effort) | Anthropic | 71.5 | 59.5 tok/s | $4.00/M |
| #19 | GPT-5.6 Luna (max) | OpenAI | 71.4 | 243.6 tok/s | $2.25/M |
| #20 | Muse Spark 1.1 (xhigh) | Meta | 71.3 | 124.3 tok/s | $2.00/M |
| #21 | GPT-5.4 (xhigh) | OpenAI | 71.1 | 154.5 tok/s | $5.63/M |
| #22 | GPT-5.4 (Non-reasoning) | OpenAI | 71.1 | 97.5 tok/s | $5.63/M |
| #23 | GPT-5.4 (low) | OpenAI | 71.1 | 98.2 tok/s | $5.63/M |
| #24 | GPT-5.6 Terra (xhigh) | OpenAI | 70.6 | 117.6 tok/s | $5.63/M |
| #25 | Gemini 3.5 Flash (medium) | 70.1 | 234.7 tok/s | $3.38/M |
| #26 | Gemini 3.5 Flash (minimal) | 70.1 | 201.4 tok/s | $3.38/M |
| #27 | Gemini 3.5 Flash (high) | 70.1 | 241.2 tok/s | $3.38/M |
| #28 | GPT-5.6 Sol (low) | OpenAI | 69.7 | 57.1 tok/s | $11.25/M |
| #29 | Gemini 3.1 Pro Preview | 68.8 | 123.1 tok/s | $4.50/M |
| #30 | GLM-5.2 (max) | Z AI | 68.8 | 149.2 tok/s | $2.15/M |
| #31 | GPT-5.6 Luna (xhigh) | OpenAI | 68.6 | 185.7 tok/s | $2.25/M |
| #32 | GPT-5.6 Terra (high) | OpenAI | 67.1 | 109.5 tok/s | $5.63/M |
| #33 | Claude Sonnet 5 (Non-reasoning, High Effort) | Anthropic | 66.4 | 57.9 tok/s | $4.00/M |
| #34 | Qwen3.7 Max | Alibaba | 66.0 | 198.9 tok/s | $3.75/M |
| #35 | GPT-5.6 Sol (Non-reasoning) | OpenAI | 65.1 | 45.3 tok/s | $11.25/M |
| #36 | GPT-5.6 Terra (medium) | OpenAI | 64.7 | 103.3 tok/s | $5.63/M |
| #37 | GPT-5.6 Luna (high) | OpenAI | 63.3 | 191.2 tok/s | $2.25/M |
| #38 | Claude Sonnet 4.6 (Non-reasoning, Low Effort) | Anthropic | 63.0 | 47.6 tok/s | $6.00/M |
| #39 | Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) | Anthropic | 63.0 | 72 tok/s | $6.00/M |
| #40 | Claude Sonnet 4.6 (Non-reasoning, High Effort) | Anthropic | 63.0 | 46.4 tok/s | $6.00/M |
| #41 | Kimi K2.6 (Non-reasoning) | Kimi | 61.8 | 35.7 tok/s | $1.71/M |
| #42 | Kimi K2.6 | Kimi | 61.8 | 39.2 tok/s | $1.71/M |
| #43 | GPT-5.5 (low) | OpenAI | 60.9 | 56.8 tok/s | $11.25/M |
| #44 | Kimi K2.7 Code | Kimi | 60.8 | 43 tok/s | $1.71/M |
| #45 | MiMo-V2.5-Pro (Non-reasoning) | Xiaomi | 60.2 | 54 tok/s | $0.926/M |
| #46 | MiMo-V2.5-Pro | Xiaomi | 60.2 | 57.1 tok/s | $0.544/M |
| #47 | KAT Coder Pro V2 | KwaiKAT | 59.5 | n/a | $0.525/M |
| #48 | DeepSeek V4 Pro (Reasoning, Max Effort) | DeepSeek | 59.4 | 63.7 tok/s | $0.544/M |
| #49 | DeepSeek V4 Pro (Reasoning, High Effort) | DeepSeek | 59.4 | 57.6 tok/s | $0.544/M |
| #50 | DeepSeek V4 Pro (Non-reasoning) | DeepSeek | 59.4 | 53.5 tok/s | $0.544/M |
| #51 | Nex-N2-Pro | Nex AGI | 59.1 | 138.6 tok/s | $1.00/M |
| #52 | Hy3-preview (Reasoning) | Tencent | 58.8 | 124.1 tok/s | $0.200/M |
| #53 | Hy3 | Tencent | 58.8 | 48 tok/s | - |
| #54 | Muse Spark | Meta | 58.6 | n/a | - |
| #55 | MiniMax-M3 | MiniMax | 58.6 | 94.8 tok/s | $0.525/M |
| #56 | GPT-5.6 Terra (low) | OpenAI | 58.1 | 102.3 tok/s | $5.63/M |
| #57 | MiMo-V2.5 | Xiaomi | 56.8 | 75.5 tok/s | $0.175/M |
| #58 | GPT-5.5 (Non-reasoning) | OpenAI | 56.5 | 57.4 tok/s | $11.25/M |
| #59 | DeepSeek V4 Flash (Reasoning, Max Effort) | DeepSeek | 56.2 | 101.1 tok/s | $0.175/M |
| #60 | DeepSeek V4 Flash (Reasoning, High Effort) | DeepSeek | 56.2 | n/a | $0.175/M |
| #61 | DeepSeek V4 Flash (Non-reasoning) | DeepSeek | 56.2 | 90.1 tok/s | $0.175/M |
| #62 | GPT-5.4 nano (medium) | OpenAI | 56.1 | 155.9 tok/s | $0.463/M |
| #63 | GPT-5.4 nano (xhigh) | OpenAI | 56.1 | 161.4 tok/s | $0.463/M |
| #64 | GPT-5.4 mini (medium) | OpenAI | 56.1 | 175.8 tok/s | $1.69/M |
| #65 | GPT-5.4 nano (Non-Reasoning) | OpenAI | 56.1 | 170.4 tok/s | $0.463/M |
| #66 | GPT-5.4 mini (xhigh) | OpenAI | 56.1 | 167.5 tok/s | $1.69/M |
| #67 | GPT-5.4 mini (Non-Reasoning) | OpenAI | 56.1 | 155.1 tok/s | $1.69/M |
| #68 | Qwen3.7 Plus | Alibaba | 55.9 | 52.4 tok/s | $0.700/M |
| #69 | GLM-5.1 (Non-reasoning) | Z AI | 55.8 | 52.4 tok/s | $2.15/M |
| #70 | GLM-5.1 (Reasoning) | Z AI | 55.8 | 67.9 tok/s | $2.15/M |
| #71 | Qwen3.6 Plus | Alibaba | 54.5 | 53.3 tok/s | $1.13/M |
| #72 | Qwen3.6 27B (Reasoning) | Alibaba | 53.7 | 56.8 tok/s | $1.35/M |
| #73 | MiniMax-M2.7 | MiniMax | 52.6 | 48.6 tok/s | $0.525/M |
| #74 | JT-4.1 Flash 236B A21B | China Mobile | 52.4 | n/a | - |
| #75 | GPT-5.6 Terra (Non-reasoning) | OpenAI | 52.3 | 101.7 tok/s | $5.63/M |
| #76 | Inkling (xhigh) | Thinking Machines | 52.1 | 82.9 tok/s | $2.57/M |
| #77 | Claude 4.5 Sonnet (Reasoning) | Anthropic | 52.1 | 50 tok/s | $6.00/M |
| #78 | Grok Build 0.1 0616 | SpaceXAI | 51.5 | 46.3 tok/s | $1.25/M |
| #79 | GPT-5.6 Luna (medium) | OpenAI | 50.7 | 185.8 tok/s | $2.25/M |
| #80 | MiMo-V2-Flash (Non-reasoning) | Xiaomi | 49.8 | n/a | - |