Easy Benchmarks
Workspace
Overview
Benchmarks
Benchmarks list
Compare
Overall Index
Coding
Math
MMLU-Pro
Speed
Value
LLMs
Audio
Image
Video
Log inSign up
Back

Speed

Runtime leaderboard using output speed and latency.

Leader

Domain score averages relative percentile across included metrics.

NVIDIA Nemotron Nano 12B v2 VL (Reasoning)

Domain score 98

SpeedTTFT

Top Speed Models

Runtime leaderboard using output speed and latency.

Domain Leaderboard

RankModelCreatorDomain ScoreSpeedBlended Price
#1NVIDIA Nemotron Nano 12B v2 VL (Reasoning)NVIDIA97.9282.5 tok/s$0.300/M
#2Command A+Cohere94.4191 tok/s-
#3
gpt-oss-20b (low)
OpenAI
93.9
260.9 tok/s
$0.095/M
#4gpt-oss-20b (high)OpenAI93.6224.5 tok/s$0.088/M
#5gpt-oss-120b (low)OpenAI92.8296.3 tok/s$0.262/M
#6Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA92.7320 tok/s$0.131/M
#7Gemini 2.5 Flash-Lite (Non-reasoning)Google92.5182.3 tok/s$0.175/M
#8Gemini 2.5 Flash (Non-reasoning)Google90.7188.7 tok/s$0.850/M
#9gpt-oss-120b (high)OpenAI89.6231.3 tok/s$0.262/M
#10Nova MicroAmazon89.1249.8 tok/s$0.061/M
#11GPT-4o (Nov '24)OpenAI88.2181.2 tok/s$4.38/M
#12MCHyperNova 60B 2605Multiverse Computing87.9350.9 tok/s$0.065/M
#13Ministral 3 3BMistral87.7158.5 tok/s$0.100/M
#14Step 3.7 FlashStepFun87.1385.2 tok/s$0.438/M
#15GPT-5.4 nano (Non-Reasoning)OpenAI86.9170.4 tok/s$0.463/M
#16Tiny Aya GlobalCohere84.8133.5 tok/s-
#17GPT-4.1 nanoOpenAI84.8148 tok/s$0.175/M
#18Mistral Small 3.2Mistral84.8144.9 tok/s$0.150/M
#19Llama 3.1 Instruct 8BMeta84.7155.5 tok/s$0.100/M
#20Step 3.5 FlashStepFun83.7247.4 tok/s$0.150/M
#21Step 3.5 Flash 2603StepFun83.4256.9 tok/s$0.150/M
#22GPT-5 (ChatGPT)OpenAI82.9158.5 tok/s$3.44/M
#23GPT-5.6 Luna (Non-reasoning)OpenAI82.4163.5 tok/s$2.25/M
#24Mistral Small 4 (Reasoning)Mistral82.4166.7 tok/s$0.262/M
#25Mistral Small 3.1Mistral82.1144.9 tok/s$0.150/M
#26Grok 4.20 0309 v2 (Non-reasoning)SpaceXAI82.1140.6 tok/s$3.00/M
#27NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)NVIDIA81.2224.5 tok/s$0.300/M
#28Mistral Small (Feb '24)Mistral81.2142.2 tok/s$1.50/M
#29GPT-5.4 mini (Non-Reasoning)OpenAI81.2155.1 tok/s$1.69/M
#30Mistral Small 4 (Non-reasoning)Mistral80.7142.1 tok/s$0.262/M
#31Ling 2.6 FlashInclusionAI80.4172.8 tok/s$0.150/M
#32Gemini 3.5 Flash (minimal)Google79.9201.4 tok/s$3.38/M
#33Nova 2.0 Lite (Non-reasoning)Amazon79.9206.7 tok/s$0.850/M
#34Gemini 3 Flash Preview (Non-reasoning)Google79.9195.8 tok/s$1.13/M
#35Trinity Large ThinkingArcee AI79.6179.7 tok/s$0.395/M
#36Nova LiteAmazon79.6147.8 tok/s$0.105/M
#37GPT-5 nano (minimal)OpenAI79.4168.7 tok/s$0.138/M
#38Granite 4.1 8BIBM78.4117.8 tok/s$0.063/M
#39Jamba 1.6 MiniAI21 Labs78.4179.6 tok/s$0.250/M
#40Mistral Small (Sep '24)Mistral76.7144.6 tok/s$0.300/M
#41Qwen3.5 Omni FlashAlibaba76.7227.8 tok/s$0.275/M
#42Mistral Small 3Mistral75.6145.3 tok/s$0.150/M
#43NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)NVIDIA74.999.8 tok/s$0.088/M
#44Cogito v2.1 (Reasoning)Deep Cogito74.996.6 tok/s$1.25/M
#45Nemotron 3 Ultra 550B A55B (Reasoning)NVIDIA74.6181.6 tok/s$1.18/M
#46Qwen3 Next 80B A3B InstructAlibaba71.7180.8 tok/s$0.875/M
#47North Mini CodeCohere71.181.4 tok/s-
#48GPT-4o (Aug '24)OpenAI70.899.6 tok/s$4.38/M
#49GLM-5.2 (max)Z AI70.3149.2 tok/s$2.15/M
#50Ministral 3 8BMistral69.889 tok/s$0.150/M
#51LFM2.5-VL-1.6BLiquid AI69.5392.7 tok/s-
#52Qwen3 Next 80B A3B (Reasoning)Alibaba69.3174.8 tok/s$1.88/M
#53GPT-3.5 TurboOpenAI69.3137.2 tok/s$0.750/M
#54Mistral 7B InstructMistral69.391.5 tok/s$0.250/M
#55Nova 2.0 Pro Preview (Non-reasoning)Amazon68.7120.2 tok/s$3.44/M
#56Kimi K2 ThinkingKimi68.5131 tok/s$1.08/M
#57Sarvam 30B (high)Sarvam68.2200.7 tok/s$0.047/M
#58Magistral Small 1.2Mistral67.983.2 tok/s$0.750/M
#59GPT-5.6 Terra (Non-reasoning)OpenAI67.6101.7 tok/s$5.63/M
#60NANex-N2-ProNex AGI67.6138.6 tok/s$1.00/M
#61Hermes 4 - Llama-3.1 70B (Non-reasoning)Nous Research67.196.2 tok/s$0.198/M
#62Qwen3 30B A3B 2507 InstructAlibaba67.1142.3 tok/s$0.350/M
#63Llama 4 MaverickMeta66.698.3 tok/s$0.475/M
#64Muse Spark 1.1 (xhigh)Meta66.5124.3 tok/s$2.00/M
#65NVIDIA Nemotron 3 Super 120B A12B (Reasoning)NVIDIA66.5145.9 tok/s$0.381/M
#66Llama 3.2 Instruct 1BMeta66.586.4 tok/s$0.100/M
#67Llama 3 Instruct 8BMeta66.079.8 tok/s$0.070/M
#68Hermes 4 - Llama-3.1 70B (Reasoning)Nous Research65.892.1 tok/s$0.198/M
#69GPT-4o (May '24)OpenAI65.894.7 tok/s$7.50/M
#70Mistral Medium 3.1Mistral65.883.6 tok/s$0.800/M
#71Qwen3.5 122B A10B (Non-reasoning)Alibaba65.7145.4 tok/s$1.10/M
#72Ministral 3 14BMistral65.375.5 tok/s$0.200/M
#73Qwen3 30B A3B 2507 (Reasoning)Alibaba65.2143.8 tok/s$0.750/M
#74Llama 4 ScoutMeta64.989.6 tok/s$0.287/M
#75GPT-5 mini (minimal)OpenAI64.7101.3 tok/s$0.688/M
#76GPT-5.4 (Non-reasoning)OpenAI64.497.5 tok/s$5.63/M
#77GPT-4.1OpenAI64.290 tok/s$3.50/M
#78GLM-4.7-Flash (Non-reasoning)Z AI64.1122.7 tok/s$0.153/M
#79Llama 3.3 Instruct 70BMeta63.787.6 tok/s$0.612/M
#80GPT-5.6 Luna (low)OpenAI63.6170.7 tok/s$2.25/M