Saltar al contenido
Easy Benchmarks
Mejores modelosHerramientasProveedoresActualizacionesAbrir benchmarks completos
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Dinos qué quieres conseguir. Easy Benchmarks convierte datos actuales de calidad, precio y velocidad en una selección sencilla.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Informe más recienteGlosario de benchmarksMetodologíallms.txt

Informe más reciente

Último informe de benchmarks de modelos de IA

Líderes actuales, cobertura, lanzamientos recientes y fuentes del conjunto de datos en vivo.

Download CSV
LLM models
575
Proveedores de modelos de IA
116
Ranking pages
12
Actualizado
16 jul 2026

Líder actual

OverallClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 59,9CodingGPT-5.6 Sol (xhigh) · 78,3MathGPT-5 (high) · 99,4%Reasoning & KnowledgeGPT-5.6 Sol (max) · 94,1%SpeedMercury 2 · 880,1 tok/sPrice & Value

Recent model releases

Inkling (xhigh)Thinking Machines · LLM15 jul 2026GPT-5.6 Sol (Non-reasoning)OpenAI · LLM9 jul 2026GPT-5.6 Terra (high)OpenAI · LLM9 jul 2026GPT-5.6 Luna (Non-reasoning)OpenAI · LLM9 jul 2026GPT-5.6 Luna (xhigh)OpenAI · LLM9 jul 2026GPT-5.6 Sol (high)OpenAI · LLM9 jul 2026GPT-5.6 Terra (Non-reasoning)OpenAI · LLM
Qwen3.5 4B (Reasoning) · 335
Artificial Analysis Math IndexGPT-5.2 (xhigh) · 99
MMLU-ProGemini 3.1 Pro Preview · 91,2%
LiveBench MathematicsGPT-5.6 Sol (max) · 96,2%
Humanity's Last ExamClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 53,3%
LiveCodeBenchGemini 3 Pro Preview (high) · 91,7%
SciCodeClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 60,2%
9 jul 2026
GPT-5.6 Terra (xhigh)OpenAI · LLM9 jul 2026
GPT-5.6 Sol (max)OpenAI · LLM9 jul 2026
GPT-5.6 Sol (xhigh)OpenAI · LLM9 jul 2026
GPT-5.6 Luna (low)OpenAI · LLM9 jul 2026
GPT-5.6 Terra (low)OpenAI · LLM9 jul 2026