Aller au contenu
Easy Benchmarks
Meilleurs modèlesOutilsFournisseursActualitésOuvrir tous les benchmarks
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Dites-nous ce que vous voulez accomplir. Easy Benchmarks transforme les données actuelles de qualité, de prix et de vitesse en une sélection simple.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Dernier rapportGlossaire des benchmarksMéthodologiellms.txt

Dernier rapport

Dernier rapport des benchmarks de modèles d’IA

Leaders actuels, couverture, sorties récentes et sources du jeu de données en direct.

Download CSV
LLM models
575
Fournisseurs de modèles d’IA
116
Ranking pages
12
Mis à jour
16 juil. 2026

Leader actuel

OverallClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 59,9CodingGPT-5.6 Sol (xhigh) · 78,3MathGPT-5 (high) · 99,4%Reasoning & KnowledgeGPT-5.6 Sol (max) · 94,1%SpeedMercury 2 · 880,1 tok/sPrice & Value

Recent model releases

Inkling (xhigh)Thinking Machines · LLM15 juil. 2026GPT-5.6 Sol (Non-reasoning)OpenAI · LLM9 juil. 2026GPT-5.6 Terra (high)OpenAI · LLM9 juil. 2026GPT-5.6 Luna (Non-reasoning)OpenAI · LLM9 juil. 2026GPT-5.6 Luna (xhigh)OpenAI · LLM9 juil. 2026GPT-5.6 Sol (high)OpenAI · LLM9 juil. 2026GPT-5.6 Terra (Non-reasoning)
Qwen3.5 4B (Reasoning) · 335
Artificial Analysis Math IndexGPT-5.2 (xhigh) · 99
MMLU-ProGemini 3.1 Pro Preview · 91,2%
LiveBench MathematicsGPT-5.6 Sol (max) · 96,2%
Humanity's Last ExamClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 53,3%
LiveCodeBenchGemini 3 Pro Preview (high) · 91,7%
SciCodeClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 60,2%
OpenAI · LLM
9 juil. 2026
GPT-5.6 Terra (xhigh)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (max)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (xhigh)OpenAI · LLM9 juil. 2026
GPT-5.6 Luna (low)OpenAI · LLM9 juil. 2026
GPT-5.6 Terra (low)OpenAI · LLM9 juil. 2026