Melhores modelos
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) é atualmente o modelo mais bem classificado para SciCode nos dados disponíveis.
Use o modelo líder como ponto de partida, não como decisão automática.
Compare as melhores opções por preço, velocidade, disponibilidade e limites.
Abra a página de resultados e a metodologia antes de citar o ranking.
SciCode focuses on scientific programming tasks, so it contributes to both coding and reasoning comparisons.
| Posição | Modelo | Fornecedor | Valor |
|---|---|---|---|
| #1 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | Anthropic | 60,2% |
| #2 | Gemini 3.1 Pro Preview | 58,9% | |
| #3 | Muse Spark 1.1 (xhigh) | Meta | 58,2% |
| #4 | GPT-5.6 Sol (high) | OpenAI | 56,9% |
| #5 | GPT-5.4 (xhigh) | OpenAI | 56,6% |
This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.
Fonte: Artificial Analysis SciCode. Atualizado: 16 de jul. de 2026.
| #6 | GPT-5.6 Sol (medium) | OpenAI | 56,5% |
| #7 | GPT-5.6 Sol (max) | OpenAI | 56,1% |
| #8 | GPT-5.5 (xhigh) | OpenAI | 56,1% |
| #9 | Gemini 3 Pro Preview (high) | 56,1% |
| #10 | GPT-5.6 Sol (xhigh) | OpenAI | 56% |
| #11 | GPT-5.5 (high) | OpenAI | 55,9% |
| #12 | GPT-5.6 Sol (low) | OpenAI | 55,4% |
| #13 | GPT-5.2 Codex (xhigh) | OpenAI | 54,6% |
| #14 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort) | Anthropic | 54,5% |
| #15 | Grok 4.5 (high) | SpaceXAI | 54,1% |
| #16 | GPT-5.6 Terra (max) | OpenAI | 53,9% |
| #17 | Claude Sonnet 5 (Adaptive Reasoning, Max Effort) | Anthropic | 53,6% |
| #18 | GPT-5.5 (medium) | OpenAI | 53,5% |
| #19 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | Anthropic | 53,5% |
| #20 | Kimi K2.6 | Kimi | 53,5% |