Outil

Comparateur de modèles IA

Sélectionnez trois modèles, obtenez le verdict par usage. Aucun test à lancer, aucun prompt à écrire — la comparaison est déjà calculée.

  1. 1Cochez trois modèlesdans le tableau ci-dessous, ou dans n’importe quel classement du site.
  2. 2Lancez la comparaisond’un clic. Rien à installer, rien à créer.
  3. 3Lisez le verdictusage par usage : qui gagne, de combien, et avec quelle solidité de mesure.

Un exemple, calculé aujourd’hui

Claude Fable 5Anthropic vsGemini 3 ProGoogle vsGrok 4.20 Beta 0309 ReasoningxAI

Claude Fable 5 domine 5 usages · Gemini 3 Pro n’arrive premier sur aucun · Grok 4.20 Beta 0309 Reasoning n’arrive premier sur aucun.

5 usages départagés sur 5 comparables · 8 usages hors périmètre

Comparaison usage par usage
Usage Claude Fable 5Gemini 3 ProGrok 4.20 Beta 0309 Reasoning Qui gagne
Généraliste 100,0 #1 94,2 #10 93,7 #17 Claude Fable 5réserve
Conversation 100,0 #1 96,2 #21 93,7 #36 Claude Fable 5
Code 75,1 #19 48,4 #178 39,2 #255 Claude Fable 5
Rapport coût / performance 100,0 #8 96,2 #26 93,7 #41 Claude Fable 5
Agents cloud 100,0 #1 94,2 #8 93,7 #13 Claude Fable 5réserve

Comparaison recalculée à chaque mise à jour du classement. Choisissez vos propres modèles ci-dessous.

Comparez les modèles de votre choix

Comparateur Le Recul

Qui gagne sur quoi

Cochez au moins deux modèles dans le tableau du classement, puis revenez ici.

Cette liste ne montre que les vingt premiers du classement général. Les 1 800 modèles restants — dont ceux de code, d’image, de vidéo, d’audio et les modèles ouverts — se comparent de la même façon depuis le classement complet, où le comparateur fonctionne à l’identique dans chacune des 13 catégories.

Vingt premiers modèles du classement général
# Modèle Éditeur Score
01 Claude Fable 5 Anthropic 100,0 / 100
02 Claude Opus 4 6 High Anthropic 99,6 / 100
03 Claude Opus 4 7 High Anthropic 99,1 / 100
04 Claude Opus 4.6 Anthropic 98,4 / 100
05 Claude Opus 4.7 Anthropic 97,7 / 100
06 Claude Opus 5 High Anthropic 97,5 / 100
07 Claude Opus 4 8 High Anthropic 95,5 / 100
08 GPT-5.4 high OpenAI 94,6 / 100
09 GPT 5.2 Chat Latest 20260210 OpenAI 94,4 / 100
10 Gemini 3 Pro Google 94,2 / 100
11 Grok 4.20 beta1 xAI 94,2 / 100
12 Claude Fable 5 1 Max Anthropic 94,1 / 100
13 Qwen3.7 Max Preview Alibaba 94,0 / 100
14 Claude Opus 4 5 20251101 High 32k Anthropic 93,9 / 100
15 Claude Opus 4.8 Anthropic 93,9 / 100
16 Claude Sonnet 4.6 Anthropic 93,7 / 100
17 Grok 4.20 Beta 0309 Reasoning xAI 93,7 / 100
18 Grok 4.5 xAI 93,5 / 100
19 Grok 4.20 Multi Agent Beta 0309 xAI 93,3 / 100
20 Ernie 5.1 Baidu 93,0 / 100

Comparer parmi les 1 800 modèles →

Nos comparatifs analysés

L’outil calcule. Nos comparatifs expliquent : contexte, limites, et ce que les chiffres ne disent pas.

Gemini Omni 1.1 Flash VS Wan 3.0 : le meilleur des deux est à moitié désactivé en France, et ce n'est pas le chinois

Comparatifs

Gemini Omni 1.1 Flash VS Wan 3.0 : le meilleur des deux est à moitié désactivé en France, et ce n'est pas le chinois

Google a publié Gemini Omni 1.1 Flash le 27 août 2026, Alibaba a ouvert Wan 3.0 quelques semaines plus tôt. Dans notre classement, trente-cinq centièmes de point les séparent. Nous avons repris les deux annonces mot à mot, recalculé le prix d'une minute livrée essais ratés compris, rassemblé les relevés de ceux qui les font tourner en production, et lu les documentations jusqu'aux restrictions que les éditeurs écrivent en petits caractères. Ce qui en ressort n'est dans aucun communiqué : les quarante secondes de Google sont un empilement de plans de dix, sa 4K est un agrandissement, et la fonction qui fait tout son intérêt — modifier vos propres vidéos — est purement et simplement bloquée en Europe. Pendant ce temps, le chinois génère trente secondes d'un seul tenant, accepte un PDF en entrée, et publie lui-même la liste de ses faiblesses.

GPT-6 Astra vs Fable 5.1 : lequel choisir en 2026 ?

Comparatifs

GPT-6 Astra vs Fable 5.1 : lequel choisir en 2026 ?

Anthropic a publié Claude Fable 5.1 le 1er septembre 2026, OpenAI a répondu avec GPT-6 Astra le 3. Tous les comparatifs annoncent une victoire d'Anthropic 66 contre 61 sur l'indice indépendant de référence. Ce chiffre vient d'une version périmée de cet indice : sur la version courante, les deux modèles sont à égalité stricte, 53 partout. Nous avons repris les dix épreuves une par une, recalculé chaque scénario de facturation, relevé nos propres rangs par niveau de réflexion, et lu ce que les deux éditeurs écrivent dans leurs pages d'aide. Il en sort trois choses qui ne figurent dans aucune annonce : les deux modèles affichent le même tarif au jeton mais la même tâche coûte deux fois plus cher chez l'un, le réglage maximal que tout le monde teste est le pire achat des deux catalogues, et un abonnement à 20 dollars par mois ne permet d'utiliser normalement ni Astra ni Fable 5.1.

Muse Glimmer contre ChatGPT gratuit : l'IA qui tourne sur votre ordinateur a-t-elle rattrapé celle du cloud ?

Comparatifs

Muse Glimmer contre ChatGPT gratuit : l'IA qui tourne sur votre ordinateur a-t-elle rattrapé celle du cloud ?

Le 10 août 2026, Meta a publié Muse Glimmer : une intelligence artificielle de 30 milliards de paramètres, libre de droits, qui tient sur un ordinateur personnel. Quatre jours plus tôt, OpenAI rendait ChatGPT illimité en texte pour tous les comptes gratuits. Deux façons opposées de ne rien payer. Nous les avons confrontées sur ce qui décide vraiment : l'intelligence mesurée sur un indice commun, la machine qu'il faut réellement acheter, la vitesse selon le matériel, ce que chacune fait de vos conversations, et le moment précis où l'une devient plus rentable que l'autre. Le résultat est net, et il n'est pas celui qu'on attend.

Voir tous les comparatifs →

Questions fréquentes

Combien de modèles peut-on comparer à la fois ?

Trois. Au-delà, le tableau devient illisible et la comparaison perd son intérêt : on ne choisit pas entre huit modèles, on choisit entre deux ou trois finalistes.

D’où viennent les scores ?

De sources publiques recoupées, agrégées quotidiennement. Chaque score porte son statut d’évaluation et le nombre de sources indépendantes qui le soutiennent.

Que veut dire « trop serré pour trancher » ?

Que l’écart entre deux modèles est plus petit que la marge d’incertitude de la mesure. Désigner un vainqueur dans ce cas serait un choix arbitraire présenté comme un résultat : le comparateur préfère le dire.

Pourquoi certaines cases indiquent « non mesuré » ?

Parce que le modèle n’apparaît dans aucune source publique pour cet usage. Rien n’est estimé ni comblé : une case vide est une information, pas un oubli.

Faut-il créer un compte ?

Non. Le comparateur est gratuit, sans inscription et sans compte. Aucune donnée personnelle n’est demandée.