Classement IA

IA Cloud — Agentique

Modèles cloud (Claude, GPT, Gemini, Grok, Qwen cloud, DeepSeek cloud, Mistral cloud…) adaptés au pilotage d'agents : modèles présents à la fois en raisonnement (général) et en code. Ce sont des modèles, pas des applications/scaffolds — OpenHands, SWE-agent, Aider, OpenCode, TRAE… restent dans Systèmes agentiques.

MAJ du classement le 21 septembre 2026 à 22:55

Top visuel

  1. 01 Claude Fable 5 100.00
  2. 02 Claude Opus 4 6 High 99.82
  3. 03 Claude Opus 4 7 High 99.28
  4. 04 Claude Opus 4.6 98.37
  5. 05 Claude Opus 4.7 97.83
  6. 06 Claude Opus 5 High 97.65
  7. 07 Claude Opus 4 8 High 95.48
  8. 08 Gemini 3 Pro 94.22
  9. 09 Claude Opus 4 5 20251101 High 32k 94.03
  10. 10 Claude Opus 4.8 94.02

Comparateur Le Recul

Qui gagne sur quoi

Cochez au moins deux modèles dans le tableau du classement, puis revenez ici.

# Modèle Éditeur Score Abonnement mensuel Évaluation
01 Anthropic 100.00 / 100 23 €/mois Partiel
02 Anthropic 99.82 / 100 23 €/mois Partiel
03 Anthropic 99.28 / 100 23 €/mois Partiel
04 Tendance à la hausse sur 30 jours (+9.0 pt de position relative, +11.27 de score — écart mesuré par rapport à sa catégorie) Anthropic 98.37 / 100 23 €/mois Partiel
05 Anthropic 97.83 / 100 23 €/mois Partiel
06 Anthropic 97.65 / 100 23 €/mois Partiel
07 Anthropic 95.48 / 100 23 €/mois Partiel
08 Google 94.22 / 100 22 €/mois Fiable
09 Anthropic 94.03 / 100 23 €/mois Partiel
10 Anthropic 94.02 / 100 23 €/mois Partiel
11 Anthropic 94.01 / 100 23 €/mois Partiel
12 xAI 93.67 / 100 Gratuit Partiel
13 Anthropic 93.63 / 100 23 €/mois Fiable
14 Tendance à la hausse sur 30 jours (+0.34 de score — écart mesuré par rapport à sa catégorie) xAI 93.13 / 100 Gratuit Partiel
15 xAI 92.59 / 100 Gratuit Partiel
16 Google 92.39 / 100 22 €/mois Fiable
17 DeepSeek 92.22 / 100 Gratuit Partiel
18 Anthropic 91.86 / 100 23 €/mois Partiel
19 Google 91.32 / 100 22 €/mois Partiel
20 OpenAI 91.06 / 100 23 €/mois Fiable
21 Anthropic 90.96 / 100 23 €/mois Partiel
22 DeepSeek 90.78 / 100 Gratuit Partiel
23 DeepSeek 89.89 / 100 Gratuit Fiable
24 Moonshot AI 89.87 / 100 Non disponible Partiel
25 OpenAI 89.51 / 100 23 €/mois Partiel
26 Tendance à la hausse sur 30 jours (+0.33 de score — écart mesuré par rapport à sa catégorie) Anthropic 89.44 / 100 23 €/mois Fiable
27 Tendance à la hausse sur 30 jours (+15.1 pt de position relative, +13.06 de score — écart mesuré par rapport à sa catégorie) xAI 89.37 / 100 Gratuit Fiable
28 Tendance à la baisse sur 30 jours (−0.42 de score — écart mesuré par rapport à sa catégorie) Inkling Thinky 88.07 / 100 Non disponible Partiel
29 Alibaba 88.00 / 100 Non disponible Fiable
30 Z.ai (zhipu ai) 87.98 / 100 Non disponible Fiable
31 DeepSeek 87.70 / 100 Gratuit Partiel
32 Google 87.69 / 100 Non disponible Partiel
33 OpenAI 87.40 / 100 23 €/mois Fiable
34 xAI 87.39 / 100 Gratuit Fiable
35 OpenAI 87.36 / 100 23 €/mois Fiable
36 Z.ai 86.80 / 100 Non disponible Partiel
37 Tendance à la baisse sur 30 jours (−1.28 de score — écart mesuré par rapport à sa catégorie) Meta 86.70 / 100 Non disponible Fiable
38 Google 86.49 / 100 22 €/mois Fiable
39 Moonshot AI 86.44 / 100 Non disponible Partiel
40 Tendance à la hausse sur 30 jours (+6.4 pt de position relative, +5.58 de score — écart mesuré par rapport à sa catégorie) DeepSeek 85.90 / 100 Gratuit Fiable
41 Meta 85.71 / 100 Non disponible Partiel
42 DeepSeek 85.35 / 100 Gratuit Partiel
43 Z.ai 85.34 / 100 Non disponible Partiel
44 Tendance à la hausse sur 30 jours (+8.8 pt de position relative, +7.66 de score — écart mesuré par rapport à sa catégorie) Moonshot AI 85.30 / 100 Non disponible Fiable
45 DeepSeek 84.88 / 100 Gratuit Fiable
46 Alibaba 84.82 / 100 Non disponible Fiable
47 Tencent 83.18 / 100 Freemium Partiel
48 OpenAI 82.64 / 100 23 €/mois Fiable
49 Anthropic 82.63 / 100 23 €/mois Fiable
50 Google 81.25 / 100 22 €/mois Fiable

Score indicatif, pondéré à partir de sources publiques. Méthodologie transparente. Voir la page Classement IA pour la méthodologie complète et les autres catégories.

Classement des IA cloud adaptées à l'usage agentique

Cette vue rassemble les modèles cloud capables de servir de moteur à un agent : ceux qui tiennent à la fois en raisonnement général et en code. Ce sont des modèles, pas des applications. Les scaffolds et environnements agentiques — OpenHands, SWE-agent, Aider, OpenCode — relèvent du classement Systèmes agentiques.

La distinction est importante en pratique. Les performances d'un agent dépendent d'abord du modèle qui le pilote, mais un excellent modèle branché sur un mauvais scaffold produit de mauvais résultats, et l'inverse est vrai aussi. Séparer les deux évite d'attribuer au modèle ce qui vient de l'outillage.

Le score est celui du classement généraliste : cette vue ne réévalue rien, elle filtre. On y trouve donc les modèles dont la double compétence raisonnement + code les rend crédibles pour des tâches longues, en gardant les réserves d'usage de tout classement à couverture partielle.

À quoi sert ce classement ?

Cette vue aide à choisir le modèle qui pilotera un agent, en écartant ceux qui excellent dans un seul domaine et décrochent dès qu'une tâche mélange raisonnement et exécution de code.

Elle rappelle aussi qu'un modèle bien classé ici ne garantit pas un agent fiable : autonomie, supervision et outillage restent des facteurs déterminants, évalués séparément.

Comment lire le classement

  • Présence simultanée en raisonnement général et en code (condition d'entrée).
  • Qualité générale et raisonnement, pondérés comme au classement généraliste.
  • Compétence code, déterminante pour l'exécution de tâches réelles.
  • Coût et vitesse, qui pèsent lourd sur des tâches longues et répétées.
  • Stabilité, condition d'une exécution autonome prolongée.

FAQ — IA Cloud — Agentique

Quelle différence avec le classement Agents IA ?

Cette vue classe des modèles ; le classement Agents IA évalue des systèmes complets (agent + outillage + supervision). Un même modèle peut donner des résultats très différents selon le système qui l'utilise.

Pourquoi le score est-il identique au classement général ?

Parce qu'il s'agit d'une sous-vue filtrée, pas d'une réévaluation. Le filtre est la double présence en raisonnement et en code ; le score reste celui du classement généraliste.

Un modèle bien classé ici fera-t-il un bon agent ?

C'est une condition favorable, pas une garantie. L'outillage, les permissions accordées et le niveau de supervision changent radicalement le résultat final.

Pourquoi certains modèles connus n'y figurent pas ?

Parce qu'ils ne sont présents que dans un des deux volets, raisonnement ou code. Le filtre exige les deux.

À quelle fréquence est-ce mis à jour ?

Environ toutes les 25 heures, automatiquement. La date de mise à jour figure en haut de page.

Voir la FAQ complète →

Classements liés