Ir para o conteúdo
Easy Benchmarks
Melhores modelosFerramentasFornecedoresAtualizaçõesAbrir benchmarks completos
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Diga o que pretende alcançar. O Easy Benchmarks transforma dados atuais de qualidade, preço e velocidade numa seleção simples.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Relatório mais recenteGlossário de benchmarksMetodologiallms.txt

Melhores modelos

Melhor modelo de IA para velocidade

Mercury 2 é atualmente o modelo mais bem classificado para velocidade nos dados disponíveis.

Abrir benchmarks completosSeletor de modelos de IA
Líder atual
Mercury 2
Valor
880,1 tok/s
Cobertura do conjunto de dados
314
Atualizado
16 de jul. de 2026

Como usar este resultado

  1. 1

    Comece pelo líder

    Use o modelo líder como ponto de partida, não como decisão automática.

  2. 2

    Veja as alternativas

    Compare as melhores opções por preço, velocidade, disponibilidade e limites.

  3. 3

    Verifique a fonte

    Abra a página de resultados e a metodologia antes de citar o ranking.

Melhores modelos

Median generated output tokens per second. Higher means the model streams completions faster after it starts responding.

PosiçãoModeloFornecedorValor
#1Mercury 2Inception880,1 tok/s
#2Granite 4.0 H SmallIBM439,5 tok/s
#3Granite 3.3 8B (Non-reasoning)IBM414,9 tok/s
#4LFM2.5-VL-1.6BLiquid AI392,7 tok/s
#5Step 3.7 FlashStepFun385,2 tok/s

Dados e evidências

This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.

Fonte: Artificial Analysis Output Speed. Atualizado: 16 de jul. de 2026.

View the live benchmark resultsView the original result pageRead the benchmark methodology

Páginas relacionadas

Melhor modelo de IA para desempenho geralMelhor modelo de IA para programaçãoMelhor modelo de IA para matemáticaMelhor modelo de IA para raciocínio e conhecimentoMelhor modelo de IA para custo-benefícioMelhor modelo de IA para Artificial Analysis Math Index
#6HyperNova 60B 2605Multiverse Computing350,9 tok/s
#7LFM2.5-8B-A1BLiquid AI343,4 tok/s
#8Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA320 tok/s
#9gpt-oss-120b (low)OpenAI296,3 tok/s
#10Gemini 3.1 Flash-LiteGoogle291,6 tok/s
#11Llama 3.1 Nemotron Instruct 70BNVIDIA286,3 tok/s
#12NVIDIA Nemotron Nano 12B v2 VL (Reasoning)NVIDIA282,5 tok/s
#13gpt-oss-20b (low)OpenAI260,9 tok/s
#14Step 3.5 Flash 2603StepFun256,9 tok/s
#15Nova MicroAmazon249,8 tok/s
#16Step 3.5 FlashStepFun247,4 tok/s
#17GPT-5.6 Luna (max)OpenAI243,6 tok/s
#18Gemini 3.5 Flash (high)Google241,2 tok/s
#19Gemini 2.5 Flash-Lite (Reasoning)Google237,8 tok/s
#20Gemini 3.5 Flash (medium)Google234,7 tok/s