Ir para o conteúdo
Easy Benchmarks
Melhores modelosFerramentasFornecedoresAtualizaçõesAbrir benchmarks completos
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Diga o que pretende alcançar. O Easy Benchmarks transforma dados atuais de qualidade, preço e velocidade numa seleção simples.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Relatório mais recenteGlossário de benchmarksMetodologiallms.txt

Melhores modelos

Melhor modelo de IA para MMLU-Pro

Gemini 3.1 Pro Preview é atualmente o modelo mais bem classificado para MMLU-Pro nos dados disponíveis.

Abrir benchmarks completosSeletor de modelos de IA
Líder atual
Gemini 3.1 Pro Preview
Valor
91,2%
Cobertura do conjunto de dados
356
Atualizado
16 de jul. de 2026

Como usar este resultado

  1. 1

    Comece pelo líder

    Use o modelo líder como ponto de partida, não como decisão automática.

  2. 2

    Veja as alternativas

    Compare as melhores opções por preço, velocidade, disponibilidade e limites.

  3. 3

    Verifique a fonte

    Abra a página de resultados e a metodologia antes de citar o ranking.

Melhores modelos

MMLU-Pro measures broad knowledge and reasoning with harder multiple-choice questions than classic MMLU.

PosiçãoModeloFornecedorValor
#1Gemini 3.1 Pro PreviewGoogle91,2%
#2Gemini 3 Pro Preview (high)Google89,8%
#3Gemini 3 Pro Preview (low)Google89,5%
#4Claude Opus 4.5 (Reasoning)Anthropic89,5%
#5Gemini 3 Flash Preview (Reasoning)Google89%

Dados e evidências

This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.

Fonte: Artificial Analysis MMLU-Pro. Atualizado: 16 de jul. de 2026.

View the live benchmark resultsView the original result pageRead the benchmark methodology

Páginas relacionadas

Melhor modelo de IA para desempenho geralMelhor modelo de IA para programaçãoMelhor modelo de IA para matemáticaMelhor modelo de IA para raciocínio e conhecimentoMelhor modelo de IA para velocidadeMelhor modelo de IA para custo-benefício
#6Claude Opus 4.5 (Non-reasoning)Anthropic88,9%
#7Gemini 3 Flash Preview (Non-reasoning)Google88,2%
#8Claude 4.1 Opus (Reasoning)Anthropic88%
#9Claude 4.5 Sonnet (Reasoning)Anthropic87,5%
#10MiniMax-M2.1MiniMax87,5%
#11GPT-5.2 (xhigh)OpenAI87,4%
#12Claude 4 Opus (Reasoning)Anthropic87,3%
#13GPT-5 (high)OpenAI87,1%
#14GPT-5.1 (high)OpenAI87%
#15GPT-5 (medium)OpenAI86,7%
#16Grok 4SpaceXAI86,6%
#17GPT-5 Codex (high)OpenAI86,5%
#18DeepSeek V3.2 SpecialeDeepSeek86,3%
#19Gemini 3.1 Flash-LiteGoogle86,2%
#20Gemini 2.5 ProGoogle86,2%