Classement IA

Chat

Préférence utilisateur, raisonnement, factualité, contexte long, simplicité, coût, vitesse.

MAJ du classement le 11 septembre 2026 à 10:52

Top visuel

  1. 01 Claude Fable 5 100.00
  2. 02 Claude Opus 4 6 High 99.64
  3. 03 Claude Opus 4 7 High 99.10
  4. 04 Claude Opus 4.6 98.38
  5. 05 Claude Opus 4.7 97.65
  6. 06 Claude Opus 5 High 97.47
  7. 07 Claude Opus 4 8 High 95.49
  8. 08 GPT-5.4 high 94.58
  9. 09 GPT 5.2 Chat Latest 20260210 94.40
  10. 10 Gemini 3 Pro 94.23

Comparateur Le Recul

Qui gagne sur quoi

Cochez au moins deux modèles dans le tableau du classement, puis revenez ici.

# Modèle Éditeur Score Abonnement mensuel Évaluation
01 Anthropic 100.00 / 100 23 €/mois Partiel
02 Anthropic 99.64 / 100 23 €/mois Partiel
03 Anthropic 99.10 / 100 23 €/mois Partiel
04 Tendance à la hausse sur 30 jours (+9.0 pt de position relative, +11.27 de score — écart mesuré par rapport à sa catégorie) Anthropic 98.38 / 100 23 €/mois Partiel
05 Anthropic 97.65 / 100 23 €/mois Partiel
06 Anthropic 97.47 / 100 23 €/mois Partiel
07 Anthropic 95.49 / 100 23 €/mois Partiel
08 OpenAI 94.58 / 100 23 €/mois Partiel
09 OpenAI 94.40 / 100 23 €/mois Partiel
10 Google 94.23 / 100 22 €/mois Fiable
11 xAI 94.22 / 100 Gratuit Partiel
12 Anthropic 94.10 / 100 23 €/mois Fiable
13 Alibaba 94.04 / 100 Non disponible Partiel
14 Anthropic 93.86 / 100 23 €/mois Partiel
15 Anthropic 93.85 / 100 23 €/mois Partiel
16 Anthropic 93.68 / 100 23 €/mois Partiel
17 xAI 93.67 / 100 Gratuit Partiel
18 Tendance à la hausse sur 30 jours (+0.34 de score — écart mesuré par rapport à sa catégorie) xAI 93.50 / 100 Gratuit Partiel
19 xAI 93.32 / 100 Gratuit Partiel
20 Baidu 92.96 / 100 Non disponible Partiel
21 Alibaba 92.60 / 100 Non disponible Partiel
22 xAI 92.42 / 100 Gratuit Partiel
23 Google 92.27 / 100 22 €/mois Fiable
24 Anthropic 91.88 / 100 23 €/mois Partiel
25 DeepSeek 91.52 / 100 Gratuit Partiel
26 xAI 91.34 / 100 Gratuit Partiel
27 Google 91.16 / 100 22 €/mois Partiel
28 OpenAI 90.94 / 100 23 €/mois Fiable
29 Anthropic 90.79 / 100 23 €/mois Partiel
30 ByteDance 90.78 / 100 Non disponible Partiel
31 DeepSeek 90.61 / 100 Gratuit Partiel
32 Moonshot AI 89.89 / 100 Non disponible Partiel
33 DeepSeek 89.79 / 100 Gratuit Fiable
34 Anthropic 89.71 / 100 23 €/mois Partiel
35 Baidu 89.53 / 100 Non disponible Partiel
36 OpenAI 89.52 / 100 23 €/mois Partiel
37 Tendance à la hausse sur 30 jours (+0.33 de score — écart mesuré par rapport à sa catégorie) Anthropic 89.45 / 100 23 €/mois Fiable
38 Tendance à la hausse sur 30 jours (+15.1 pt de position relative, +13.06 de score — écart mesuré par rapport à sa catégorie) xAI 89.37 / 100 Gratuit Fiable
39 OpenAI 89.35 / 100 23 €/mois Partiel
40 Baidu 88.99 / 100 Non disponible Partiel
41 OpenAI 88.45 / 100 23 €/mois Partiel
42 Z.ai (zhipu ai) 87.91 / 100 Non disponible Fiable
43 Alibaba 87.83 / 100 Non disponible Fiable
44 Tendance à la baisse sur 30 jours (−0.42 de score — écart mesuré par rapport à sa catégorie) Inkling Thinky 87.73 / 100 Non disponible Partiel
45 DeepSeek 87.55 / 100 Gratuit Partiel
46 Google 87.54 / 100 Non disponible Partiel
47 OpenAI 87.53 / 100 23 €/mois Partiel
48 xAI 87.39 / 100 Gratuit Fiable
49 OpenAI 87.30 / 100 23 €/mois Fiable
50 OpenAI 87.26 / 100 23 €/mois Fiable

Score indicatif, pondéré à partir de sources publiques. Méthodologie transparente. Voir la page Classement IA pour la méthodologie complète et les autres catégories.

Classement des IA de chat

Le classement Chat de Le Recul compare les grands modèles de langage utilisés au quotidien pour discuter, rédiger, résumer et raisonner : Claude, ChatGPT (GPT), Gemini, Grok, DeepSeek, Mistral, Qwen et leurs déclinaisons. Contrairement aux comparatifs marketing, il ne cherche pas à désigner un « meilleur outil absolu » : un modèle excellent en raisonnement long peut décevoir sur la factualité, ou coûter trop cher pour un usage régulier.

Le score agrège plusieurs signaux publics — préférence utilisateur, qualité de raisonnement, exactitude factuelle, gestion du contexte long, vitesse et coût d'abonnement — pondérés selon une grille « Chat » documentée. L'objectif est de refléter ce que vaut un modèle en conversation réelle, pas sa performance sur un seul benchmark isolé.

Ce classement mesure une tendance, pas une vérité figée. Les modèles évoluent vite, les pondérations sont publiques, et chaque évaluation porte un statut (Fiable, Partiel, Insuffisant) selon la couverture des sources. À lire comme un point de repère pour choisir selon votre usage — écriture, support, analyse, code léger — et non comme un palmarès définitif.

À quoi sert ce classement ?

Ce classement aide à choisir un assistant conversationnel selon un usage précis plutôt que sur la hype du moment. Un modèle peut dominer en raisonnement et rester médiocre en factualité, ou être très rapide mais limité en contexte long.

Il sert aussi à relativiser les annonces : une nouvelle version présentée comme « révolutionnaire » ne change pas forcément le classement tant que ses gains réels ne sont pas confirmés par des sources publiques.

Comment lire le classement

  • Préférence utilisateur : ce que les humains préfèrent réellement en aveugle, pas les scores d'annonce.
  • Raisonnement et factualité : suivre une consigne complexe sans inventer.
  • Contexte long : tenue sur de longs documents ou conversations.
  • Coût d'abonnement mensuel public, pas le prix API au token.
  • Statut d'évaluation (Fiable / Partiel / Insuffisant) selon la couverture des sources.

FAQ — Chat

Quel est le meilleur modèle de chat ?

Il n'y a pas de « meilleur » universel. Le classement reflète un équilibre entre raisonnement, factualité, contexte, vitesse et coût. Le bon choix dépend de votre usage : écriture, support client, analyse ou code léger.

À quelle fréquence le classement est-il mis à jour ?

Les données sont rafraîchies automatiquement environ toutes les 25 heures à partir de sources publiques. La date de mise à jour est affichée en haut de page.

Pourquoi un modèle connu est-il marqué « Partiel » ?

Le statut dépend de la couverture des sources publiques disponibles. « Partiel » signifie que les données ne suffisent pas encore à un verdict fort, pas que le modèle est mauvais.

Le coût pris en compte est-il le prix de l'API ?

Non. Pour le chat grand public, c'est l'abonnement mensuel public (Pro / Plus / Advanced) qui est considéré, pas le coût par token de l'API.

Comment est calculé le score ?

C'est un score composite pondéré selon une grille « Chat » documentée. La méthodologie complète est consultable sur la page principale du classement.

Voir la FAQ complète →

À lire aussi

Classements liés