Meilleurs modèles
Realtime TTS 1.5 Max est actuellement le modèle le mieux classé pour Text-to-Speech dans les données disponibles.
Utilisez le premier modèle comme point de départ, pas comme décision automatique.
Comparez les meilleurs choix selon le prix, la vitesse, la disponibilité et vos contraintes.
Ouvrez la page de résultats et la méthodologie avant de citer le classement.
Artificial Analysis Elo ratings for text-to-speech model quality.
| Rang | Modèle | Fournisseur | Valeur |
|---|---|---|---|
| #1 | Realtime TTS 1.5 Max | Inworld | 1 208 Elo |
| #2 | Gemini 3.1 Flash TTS | 1 203 Elo | |
| #3 | Eleven v3 | ElevenLabs | 1 177 Elo |
| #4 | Inworld TTS 1 Max | Inworld | 1 166 Elo |
| #5 | Speech 2.8 HD | MiniMax |
This ranking uses the current Elo results from the matching Artificial Analysis media leaderboard.
Source: Artificial Analysis Text-to-Speech leaderboard. Mis à jour: 4 mai 2026.
| 1 164 Elo |
| #6 | Realtime TTS 1.5 Mini | Inworld | 1 159 Elo |
| #7 | Step TTS 2 (Mar 2026) | StepFun | 1 149 Elo |
| #8 | Speech 2.8 Turbo | MiniMax | 1 146 Elo |
| #9 | Speech 2.6 HD | MiniMax | 1 133 Elo |
| #10 | Speech 2.6 Turbo | MiniMax | 1 128 Elo |
| #11 | Fish Audio S2 Pro | Fish Audio | 1 124 Elo |
| #12 | Azure HD 2.5 | Microsoft | 1 122 Elo |
| #13 | Speech-02-HD | MiniMax | 1 117 Elo |
| #14 | Inworld TTS 1 | Inworld | 1 114 Elo |
| #15 | Multilingual v2 | ElevenLabs | 1 106 Elo |
| #16 | Step Audio EditX (Mar 2026) | StepFun | 1 101 Elo |
| #17 | TTS-1 | OpenAI | 1 100 Elo |
| #18 | Speech-02-Turbo | MiniMax | 1 098 Elo |
| #19 | Turbo v2.5 | ElevenLabs | 1 097 Elo |
| #20 | TTS-1 HD | OpenAI | 1 097 Elo |