Ir para o conteúdo
Easy Benchmarks
Melhores modelosFerramentasFornecedoresAtualizaçõesAbrir benchmarks completos
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Diga o que pretende alcançar. O Easy Benchmarks transforma dados atuais de qualidade, preço e velocidade numa seleção simples.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Relatório mais recenteGlossário de benchmarksMetodologiallms.txt

Melhores modelos

Melhor modelo de IA para AIME

GPT-5 (high) é atualmente o modelo mais bem classificado para AIME nos dados disponíveis.

Abrir benchmarks completosSeletor de modelos de IA
Líder atual
GPT-5 (high)
Valor
95,7%
Cobertura do conjunto de dados
194
Atualizado
16 de jul. de 2026

Como usar este resultado

  1. 1

    Comece pelo líder

    Use o modelo líder como ponto de partida, não como decisão automática.

  2. 2

    Veja as alternativas

    Compare as melhores opções por preço, velocidade, disponibilidade e limites.

  3. 3

    Verifique a fonte

    Abra a página de resultados e a metodologia antes de citar o ranking.

Melhores modelos

AIME measures advanced competition math performance. Higher percentages indicate more solved problems.

PosiçãoModeloFornecedorValor
#1GPT-5 (high)OpenAI95,7%
#2Grok 4SpaceXAI94,3%
#3o4-mini (high)OpenAI94%
#4Qwen3 235B A22B 2507 (Reasoning)Alibaba94%
#5Grok 3 mini Reasoning (high)SpaceXAI93,3%

Dados e evidências

This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.

Fonte: Artificial Analysis AIME. Atualizado: 16 de jul. de 2026.

View the live benchmark resultsView the original result pageRead the benchmark methodology

Páginas relacionadas

Melhor modelo de IA para desempenho geralMelhor modelo de IA para programaçãoMelhor modelo de IA para matemáticaMelhor modelo de IA para raciocínio e conhecimentoMelhor modelo de IA para velocidadeMelhor modelo de IA para custo-benefício
#6GPT-5 (medium)OpenAI91,7%
#7Qwen3 30B A3B 2507 (Reasoning)Alibaba90,7%
#8o3OpenAI90,3%
#9DeepSeek R1 0528 (May '25)DeepSeek89,3%
#10Gemini 2.5 ProGoogle88,7%
#11GLM-4.5 (Reasoning)Z AI87,3%
#12Gemini 2.5 Pro Preview (Mar' 25)Google87%
#13Llama Nemotron Super 49B v1.5 (Reasoning)NVIDIA86%
#14o3-mini (high)OpenAI86%
#15MiniMax M1 80kMiniMax84,7%
#16EXAONE 4.0 32B (Reasoning)LG AI Research84,3%
#17Gemini 2.5 Flash Preview (Reasoning)Google84,3%
#18Gemini 2.5 Pro Preview (May' 25)Google84,3%
#19Qwen3 235B A22B (Reasoning)Alibaba84%
#20GPT-5 (low)OpenAI83%