Zum Inhalt springen
Easy Benchmarks
Beste ModelleToolsAnbieterUpdatesVollständige Benchmarks öffnen
EnglishFrançaisEspañolDeutschPortuguês

Easy Benchmarks

Sag uns, was du erreichen möchtest. Easy Benchmarks übersetzt aktuelle Benchmark-, Preis- und Geschwindigkeitsdaten in eine einfache Auswahl.

Benchmark data is attributed to Artificial Analysis. Model metadata and catalog pricing may also use Vercel AI Gateway data when available.

Aktueller BerichtBenchmark-GlossarMethodikllms.txt

Beste Modelle

Bestes KI-Modell für Schlussfolgern und Wissen

GPT-5.6 Sol (max) ist derzeit das bestplatzierte Modell für Schlussfolgern und Wissen in den verfügbaren Daten.

Vollständige Benchmarks öffnenKI-Modellfinder
Aktueller Spitzenreiter
GPT-5.6 Sol (max)
Wert
94,1%
Datensatzabdeckung
540
Aktualisiert
16.07.2026

So nutzt du dieses Ergebnis

  1. 1

    Mit dem Spitzenreiter beginnen

    Nutze den Erstplatzierten als Ausgangspunkt, nicht als automatische Entscheidung.

  2. 2

    Die besten Optionen prüfen

    Vergleiche die ersten Modelle bei Preis, Geschwindigkeit und Verfügbarkeit.

  3. 3

    Die Quelle prüfen

    Öffne die verlinkte Ergebnisseite und Methodik, bevor du das Ergebnis zitierst.

Top-Modelle

GPQA is a difficult graduate-level science benchmark. Higher percentages indicate stronger expert reasoning performance.

RangModellAnbieterWert
#1GPT-5.6 Sol (max)OpenAI94,1%
#2Gemini 3.1 Pro PreviewGoogle94,1%
#3GPT-5.5 (xhigh)OpenAI93,5%
#4GPT-5.5 (high)OpenAI93,2%
#5GPT-5.6 Sol (xhigh)OpenAI93,1%

Daten & Nachweise

This answer uses the exact same metric and live database ranking as the linked Easy Benchmarks leaderboard.

Quelle: Artificial Analysis GPQA. Aktualisiert: 16.07.2026.

View the live benchmark resultsView the original result pageRead the benchmark methodology

Verwandte Seiten

Bestes KI-Modell für allgemeine LeistungBestes KI-Modell für ProgrammierungBestes KI-Modell für MathematikBestes KI-Modell für GeschwindigkeitBestes KI-Modell für Preis-LeistungBestes KI-Modell für Artificial Analysis Math Index
#6
Grok 4.5 (high)
SpaceXAI
93,1%
#7MiniMax-M3MiniMax92,9%
#8GPT-5.6 Sol (high)OpenAI92,8%
#9GPT-5.5 (medium)OpenAI92,6%
#10GPT-5.6 Sol (medium)OpenAI92,6%
#11Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)Anthropic92,6%
#12GPT-5.6 Terra (max)OpenAI92,5%
#13Qwen3.7 MaxAlibaba92,3%
#14Gemini 3.5 Flash (high)Google92,2%
#15Gemini 3.5 Flash (medium)Google92,1%
#16Claude Opus 4.8 (Adaptive Reasoning, Max Effort)Anthropic92%
#17GPT-5.4 (xhigh)OpenAI92%
#18GPT-5.3 Codex (xhigh)OpenAI91,5%
#19Claude Opus 4.7 (Adaptive Reasoning, Max Effort)Anthropic91,4%
#20GPT-5.6 Luna (max)OpenAI91,1%