Classement IA
IA Cloud — Agentique
Modèles cloud (Claude, GPT, Gemini, Grok, Qwen cloud, DeepSeek cloud, Mistral cloud…) adaptés au pilotage d'agents : modèles présents à la fois en raisonnement (général) et en code. Ce sont des modèles, pas des applications/scaffolds — OpenHands, SWE-agent, Aider, OpenCode, TRAE… restent dans Systèmes agentiques.
Top visuel
- 01 Claude Fable 5 100.00
- 02 Claude Opus 4.6 Thinking 99.28
- 03 Claude Opus 4.7 Thinking 98.74
- 04 Claude Opus 4.7 96.95
- 05 Claude Opus 5 High 96.94
- 06 Muse Spark 1.1 96.59
- 07 Claude Opus 4.8thinking 95.51
- 08 Gemini 3.6 flash 95.33
- 09 Gemini 3 Pro 93.95
- 10 Claude Opus 4.8 93.90
| # | Modèle | Éditeur | Score | Abonnement mensuel | Évaluation | |
|---|---|---|---|---|---|---|
| 01 | Anthropic | 100.00 / 100 | 23 €/mois | Partiel | ||
| 02 | Anthropic | 99.28 / 100 | 23 €/mois | Partiel | ||
| 03 | Anthropic | 98.74 / 100 | 23 €/mois | Partiel | ||
| 04 | Anthropic | 96.95 / 100 | 23 €/mois | Partiel | ||
| 05 | Anthropic | 96.94 / 100 | 23 €/mois | Partiel | ||
| 06 | Meta | 96.59 / 100 | Non disponible | Partiel | ||
| 07 | Anthropic | 95.51 / 100 | 23 €/mois | Partiel | ||
| 08 | 95.33 / 100 | 22 €/mois | Partiel | |||
| 09 | 93.95 / 100 | 22 €/mois | Fiable | |||
| 10 | Anthropic | 93.90 / 100 | 23 €/mois | Partiel | ||
| 11 | Anthropic | 93.54 / 100 | 23 €/mois | Partiel | ||
| 12 | Anthropic | 93.36 / 100 | 23 €/mois | Partiel | ||
| 13 | xAI | 93.35 / 100 | Gratuit | Partiel | ||
| 14 | xAI | 92.82 / 100 | Gratuit | Partiel | ||
| 15 | xAI | 92.28 / 100 | Gratuit | Partiel | ||
| 16 | 91.90 / 100 | 22 €/mois | Fiable | |||
| 17 | Anthropic | 91.56 / 100 | 23 €/mois | Partiel | ||
| 18 | 91.02 / 100 | 22 €/mois | Partiel | |||
| 19 | OpenAI | 90.57 / 100 | 23 €/mois | Fiable | ||
| 20 | Anthropic | 90.48 / 100 | 23 €/mois | Partiel | ||
| 21 | DeepSeek | 90.13 / 100 | Gratuit | Partiel | ||
| 22 | DeepSeek | 89.61 / 100 | Gratuit | Fiable | ||
| 23 | Moonshot AI | 89.41 / 100 | Non disponible | Partiel | ||
| 24 | OpenAI | 89.23 / 100 | 23 €/mois | Partiel | ||
| 25 | Anthropic | 88.56 / 100 | 23 €/mois | Fiable | ||
| 26 | Alibaba | 87.92 / 100 | Non disponible | Fiable | ||
| 27 | Inkling | Thinky | 87.79 / 100 | Non disponible | Partiel | |
| 28 | Z.ai (zhipu ai) | 87.62 / 100 | Non disponible | Fiable | ||
| 29 | DeepSeek | 87.25 / 100 | Gratuit | Partiel | ||
| 30 | 87.24 / 100 | Non disponible | Partiel | |||
| 31 | OpenAI | 87.09 / 100 | 23 €/mois | Fiable | ||
| 32 | xAI | 87.05 / 100 | Gratuit | Fiable | ||
| 33 | OpenAI | 86.94 / 100 | 23 €/mois | Fiable | ||
| 34 | Z.ai | 86.36 / 100 | Non disponible | Partiel | ||
| 35 | 86.19 / 100 | 22 €/mois | Fiable | |||
| 36 | Moonshot AI | 86.18 / 100 | Non disponible | Partiel | ||
| 37 | DeepSeek | 84.92 / 100 | Gratuit | Partiel | ||
| 38 | Z.ai | 84.91 / 100 | Non disponible | Partiel | ||
| 39 | DeepSeek | 84.71 / 100 | Gratuit | Fiable | ||
| 40 | Alibaba | 84.56 / 100 | Non disponible | Fiable | ||
| 41 | Tencent | 82.59 / 100 | Freemium | Partiel | ||
| 42 | Anthropic | 82.21 / 100 | 23 €/mois | Fiable | ||
| 43 | Anthropic | 82.17 / 100 | 23 €/mois | Fiable | ||
| 44 | OpenAI | 82.12 / 100 | 23 €/mois | Fiable | ||
| 45 | Alibaba | 81.61 / 100 | Non disponible | Fiable | ||
| 46 | OpenAI | 81.20 / 100 | 23 €/mois | Fiable | ||
| 47 | 81.04 / 100 | 22 €/mois | Fiable | |||
| 48 | xAI | 80.91 / 100 | Gratuit | Fiable | ||
| 49 | 80.75 / 100 | 22 €/mois | Fiable | |||
| 50 | Alibaba | 80.54 / 100 | Non disponible | Fiable |
Score indicatif, pondéré à partir de sources publiques. Méthodologie transparente. Voir la page Classement IA pour la méthodologie complète et les autres catégories.
Classement des IA cloud adaptées à l'usage agentique
Cette vue rassemble les modèles cloud capables de servir de moteur à un agent : ceux qui tiennent à la fois en raisonnement général et en code. Ce sont des modèles, pas des applications. Les scaffolds et environnements agentiques — OpenHands, SWE-agent, Aider, OpenCode — relèvent du classement Systèmes agentiques.
La distinction est importante en pratique. Les performances d'un agent dépendent d'abord du modèle qui le pilote, mais un excellent modèle branché sur un mauvais scaffold produit de mauvais résultats, et l'inverse est vrai aussi. Séparer les deux évite d'attribuer au modèle ce qui vient de l'outillage.
Le score est celui du classement généraliste : cette vue ne réévalue rien, elle filtre. On y trouve donc les modèles dont la double compétence raisonnement + code les rend crédibles pour des tâches longues, en gardant les réserves d'usage de tout classement à couverture partielle.
À quoi sert ce classement ?
Cette vue aide à choisir le modèle qui pilotera un agent, en écartant ceux qui excellent dans un seul domaine et décrochent dès qu'une tâche mélange raisonnement et exécution de code.
Elle rappelle aussi qu'un modèle bien classé ici ne garantit pas un agent fiable : autonomie, supervision et outillage restent des facteurs déterminants, évalués séparément.
Comment lire le classement
- Présence simultanée en raisonnement général et en code (condition d'entrée).
- Qualité générale et raisonnement, pondérés comme au classement généraliste.
- Compétence code, déterminante pour l'exécution de tâches réelles.
- Coût et vitesse, qui pèsent lourd sur des tâches longues et répétées.
- Stabilité, condition d'une exécution autonome prolongée.
FAQ — IA Cloud — Agentique
Quelle différence avec le classement Agents IA ?
Cette vue classe des modèles ; le classement Agents IA évalue des systèmes complets (agent + outillage + supervision). Un même modèle peut donner des résultats très différents selon le système qui l'utilise.
Pourquoi le score est-il identique au classement général ?
Parce qu'il s'agit d'une sous-vue filtrée, pas d'une réévaluation. Le filtre est la double présence en raisonnement et en code ; le score reste celui du classement généraliste.
Un modèle bien classé ici fera-t-il un bon agent ?
C'est une condition favorable, pas une garantie. L'outillage, les permissions accordées et le niveau de supervision changent radicalement le résultat final.
Pourquoi certains modèles connus n'y figurent pas ?
Parce qu'ils ne sont présents que dans un des deux volets, raisonnement ou code. Le filtre exige les deux.
À quelle fréquence est-ce mis à jour ?
Environ toutes les 25 heures, automatiquement. La date de mise à jour figure en haut de page.
Classements liés
Ouvrir le site officiel ?
—
Vous serez redirigé vers — dans un nouvel onglet.