Aller au contenu
Easy Benchmarks
Meilleurs modèlesOutilsFournisseursActualitésOuvrir tous les benchmarks
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Dites-nous ce que vous voulez accomplir. Easy Benchmarks transforme les données actuelles de qualité, de prix et de vitesse en une sélection simple.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Dernier rapportGlossaire des benchmarksMéthodologiellms.txt

Actualités

Dernières actualités des modèles d’IA

Dernières sorties datées, leaders actuels et état du jeu de données.

Dernier rapport
Current LLM rows
575
Recent dated releases
30
Current leaders
8
Mis à jour
16 juil. 2026

Current benchmark leaders

OverallClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) · 59,9CodingGPT-5.6 Sol (xhigh) · 78,3MathGPT-5 (high) · 99,4%Reasoning & KnowledgeGPT-5.6 Sol (max) · 94,1%SpeedMercury 2 · 880,1 tok/sPrice & ValueQwen3.5 4B (Reasoning) · 335Artificial Analysis Math IndexGPT-5.2 (xhigh) · 99MMLU-ProGemini 3.1 Pro Preview · 91,2%

Recent model releases

Inkling (xhigh)Thinking Machines · LLM15 juil. 2026GPT-5.6 Sol (Non-reasoning)OpenAI · LLM9 juil. 2026GPT-5.6 Terra (high)OpenAI · LLM9 juil. 2026GPT-5.6 Luna (Non-reasoning)OpenAI · LLM9 juil. 2026GPT-5.6 Luna (xhigh)OpenAI · LLM9 juil. 2026GPT-5.6 Sol (high)OpenAI · LLM9 juil. 2026GPT-5.6 Terra (Non-reasoning)
OpenAI · LLM
9 juil. 2026
GPT-5.6 Terra (xhigh)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (max)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (xhigh)OpenAI · LLM9 juil. 2026
GPT-5.6 Luna (low)OpenAI · LLM9 juil. 2026
GPT-5.6 Terra (low)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (low)OpenAI · LLM9 juil. 2026
GPT-5.6 Terra (medium)OpenAI · LLM9 juil. 2026
GPT-5.6 Luna (max)OpenAI · LLM9 juil. 2026
GPT-5.6 Luna (medium)OpenAI · LLM9 juil. 2026
GPT-5.6 Terra (max)OpenAI · LLM9 juil. 2026
GPT-5.6 Luna (high)OpenAI · LLM9 juil. 2026
GPT-5.6 Sol (medium)OpenAI · LLM9 juil. 2026
Muse Spark 1.1 (xhigh)Meta · LLM9 juil. 2026
JT-4.1 Flash 236B A21BChina Mobile · LLM9 juil. 2026
Grok 4.5 (high)SpaceXAI · LLM8 juil. 2026
Hy3Tencent · LLM6 juil. 2026
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)Anthropic · LLM30 juin 2026
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)Anthropic · LLM30 juin 2026
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)Anthropic · LLM30 juin 2026
Claude Sonnet 5 (Adaptive Reasoning, High Effort)Anthropic · LLM30 juin 2026
Claude Sonnet 5 (Non-reasoning, High Effort)Anthropic · LLM30 juin 2026
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)Anthropic · LLM30 juin 2026
LongCat 2.0LongCat · LLM29 juin 2026