Mejores modelos
Gemini 3 Pro Preview (high) es actualmente el modelo mejor clasificado para LiveCodeBench en los datos disponibles.
Usa el modelo líder como punto de partida, no como una decisión automática.
Compara las mejores opciones por precio, velocidad, disponibilidad y tus límites.
Abre la página de resultados y la metodología antes de citar el ranking.
LiveCodeBench evaluates coding ability on recent programming problems, helping reduce benchmark memorization effects.
| Posición | Modelo | Proveedor | Valor |
|---|---|---|---|
| #1 | Gemini 3 Pro Preview (high) | 91,7% | |
| #2 | Gemini 3 Flash Preview (Reasoning) | 90,8% | |
| #3 | DeepSeek V3.2 Speciale | DeepSeek | 89,6% |
| #4 | GPT-5.2 (medium) | OpenAI | 89,4% |
| #5 | GLM-4.7 (Reasoning) | Z AI | 89,4% |
This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.
Fuente: Artificial Analysis LiveCodeBench. Actualizado: 16 jul 2026.
| #6 | GPT-5.2 (xhigh) | OpenAI | 88,9% |
| #7 | gpt-oss-120b (high) | OpenAI | 87,8% |
| #8 | Claude Opus 4.5 (Reasoning) | Anthropic | 87,1% |
| #9 | GPT-5.1 (high) | OpenAI | 86,8% |
| #10 | MiMo-V2-Flash (Reasoning) | Xiaomi | 86,8% |
| #11 | DeepSeek V3.2 (Reasoning) | DeepSeek | 86,2% |
| #12 | o4-mini (high) | OpenAI | 85,9% |
| #13 | Gemini 3 Pro Preview (low) | 85,7% |
| #14 | Kimi K2 Thinking | Kimi | 85,3% |
| #15 | GPT-5.1 Codex (high) | OpenAI | 84,9% |
| #16 | GPT-5 (high) | OpenAI | 84,6% |
| #17 | GPT-5 Codex (high) | OpenAI | 84% |
| #18 | GPT-5 mini (high) | OpenAI | 83,8% |
| #19 | GPT-5.1 Codex mini (high) | OpenAI | 83,6% |
| #20 | Grok 4 Fast (Reasoning) | SpaceXAI | 83,2% |