OpenAI, qui était historiquement la référence, n’est plus en tête de ce classement. Anthropic domine cette édition, mais surtout, la compétition est devenue plus ouverte.
Le classement d’août 2026 de la Text Arena dessine une nouvelle hiérarchie entre les principaux modèles d’intelligence artificielle. Anthropic occupe 7 des dix premières places avec différentes déclinaisons de Claude.
| 1 |
Claude Fable 5 |
Anthropic |
| 2 |
Claude Opus 4.6 High |
Anthropic |
| 3 |
Claude Opus 4.7 High |
Anthropic |
| 5 |
Claude Opus 4.6 |
Anthropic |
| 6 |
Claude Opus 4.7 |
Anthropic |
| 7 |
Claude Opus 5 High |
Anthropic |
| 9 |
Gemini 3.7 Flash High |
Google |
| 10 |
Claude Opus 5 Max |
Anthropic |
Pour OpenAI, le classement marque un recul important. GPT-5.5 High arrive à la 17e place et GPT-5.6 Sol xHigh à la 19e, ce qui place les deux modèles hors du top 15. Le résultat est notable pour une entreprise qui a longtemps occupé le sommet des classements d’IA. En face, Anthropic place sept modèles dans les dix premières positions, dont Claude Fable 5 en tête. Le classement montre ainsi que l’avance historique d’OpenAI n’est plus suffisante pour garantir une position dominante. Mais le changement ne se limite pas au duel entre OpenAI et Anthropic. Alibaba place Qwen 3.8 Max à la 8e position et Kimi K3 Max atteint la 12e place. Google et Meta figurent également dans le top 10. Autrement dit, les positions se multiplient autour des deux leaders historiques du marché américain. La hiérarchie devient plus disputée et laisse davantage de place aux acteurs chinois et aux nouveaux modèles.
Les autres classements de l’Arena vont dans le même sens. Anthropic arrive en tête de la Search Arena avec Claude Opus 4.6 Search et domine également la Document Arena, où ses modèles occupent les six premières places. Dans la Vision Arena, Claude Fable 5 arrive premier, mais Qwen 3.8 Max prend la deuxième place. Ces résultats montrent surtout qu’il n’existe plus un seul classement permettant de dire quel modèle est “le meilleur” dans tous les usages. La performance dépend désormais de la tâche évaluée.
C’est là que se situe le principal enseignement de cette étude. La Text Arena ne mesure pas seulement qui produit les meilleures réponses : elle permet d’observer comment la hiérarchie entre les modèles évolue lorsque ceux-ci sont confrontés directement par les utilisateurs. Les réponses sont comparées en aveugle, puis les résultats sont traduits dans un classement de type Elo. Une première place signifie donc qu’un modèle est davantage préféré dans ces confrontations et non qu’il est supérieur dans absolument tous les domaines.
Le classement d’août 2026 donne ainsi un signal précis. OpenAI n’occupe plus automatiquement le sommet de la hiérarchie, tandis qu’Anthropic s’impose comme le principal bénéficiaire de ce basculement. Mais l’étude montre également que la concurrence s’élargit. Alibaba, Google, Meta et les nouveaux acteurs chinois sont désormais capables de se positionner parmi les meilleurs selon les modèles et les usages évalués. La course à l’IA passe donc d’une logique dominée par quelques références à une compétition beaucoup plus ouverte.