Le 6 octobre 2026, Mistral a ouvert la préversion publique de son plus gros modèle. Il s’appelle Mistral Large 4, l’entreprise le surnomme « le Chonk », et l’annonce est titrée « Forged in Europe. Built for AI sovereignty » — forgé en Europe, conçu pour la souveraineté de l’IA.
Le modèle est sérieux et les chiffres sont là. Mais trois affirmations ont fait le tour des reprises francophones sans être vérifiées : qu’il est ouvert, qu’il est souverain de bout en bout, et qu’il détient un record mondial en cybersécurité. Nous avons lu l’annonce, la documentation technique, la page tarifaire et le tour de table. Les trois sont partiellement exactes. Aucune ne veut dire ce qu’on lui fait dire.
Ce que Mistral a annoncé le 6 octobre 2026
Les caractéristiques, telles que l’entreprise les publie. Un détail mérite d’être noté d’emblée : l’annonce et la documentation ne donnent pas tout à fait le même chiffre.
| Caractéristique | Mistral Large 4 | Mistral Large 3 |
|---|---|---|
| Date | 6 octobre 2026 (préversion publique) | 2 décembre 2025 |
| Paramètres totaux | 1 000 milliards (annonce) / 1,05 T (documentation) | 675 milliards |
| Paramètres actifs | 52 milliards | environ 41 milliards |
| Contexte | 1 million de tokens | 256 000 tokens |
| Entrées | Texte et image, sortie texte | Texte et image |
| Entraînement | 3 800 GPU Nvidia Grace Blackwell | environ 3 000 GPU Nvidia H200 |
| Licence | « Coming soon » | Apache 2.0 |
| Poids téléchargeables | « Coming soon » | Oui |
Un point de vocabulaire utile pour la suite. Un modèle à « poids ouverts » est un modèle dont les fichiers de paramètres peuvent être téléchargés et exécutés sur ses propres machines. Ce n’est pas la même chose qu’un modèle « open source » au sens logiciel, et surtout, ce n’est pas une garantie d’usage libre : tout dépend de la licence attachée aux fichiers.
Le mot qui revient six fois, et les deux cases restées vides
Dans l’annonce du 6 octobre, le terme « open-weight » ou « open weights » apparaît six fois. Le modèle y est décrit comme poussant « the frontier of open-weight performance ».
La fiche technique officielle du modèle, sur docs.mistral.ai, comporte un onglet « Weights ». Il contient un tableau à sept colonnes. Les deux premières sont celles qui comptent.
| Weights | License | Parameters (T) | Active (B) | Context |
|---|---|---|---|---|
| Coming soon | Coming soon | 1,05 | 52 | 1M |
Les poids : à venir. La licence : à venir.
Cela n’est pas un mensonge, et il faut le dire aussi clairement que le reste : l’annonce indique noir sur blanc « We will release the weights by the end of the month », les poids seront publiés d’ici la fin du mois. Mistral n’a pas caché le calendrier, il l’a écrit.
Mais entre « ce modèle est ouvert » et « ce modèle sera ouvert à des conditions qui ne sont pas encore connues », il y a un écart que la plupart des reprises ont effacé. Au 9 octobre 2026, personne à l’extérieur de Mistral ne peut dire à quelles conditions ce modèle pourra être installé quelque part.
Dans le propre catalogue de Mistral, Large 4 est le seul sans licence nommée
C’est la vérification la plus simple, et la plus parlante. Le catalogue officiel des modèles de Mistral affiche un badge de licence sous chaque modèle. Voici ce qu’il affiche au 9 octobre 2026.
| Modèle | Badge affiché | Usage commercial |
|---|---|---|
| Mistral Large 3 | APACHE 2.0 | Autorisé sans condition |
| Mistral Small 4 | APACHE 2.0 | Autorisé sans condition |
| Ministral 3 (3B, 8B, 14B) | APACHE 2.0 | Autorisé sans condition |
| Mistral Medium 3.5 | MODIFIED MIT | Sous conditions |
| Voxtral TTS | CC BY-NC 4.0 | Interdit |
| Mistral Large 4 | OPEN | Inconnu |
Tous les autres modèles ouverts du catalogue portent une licence nommée. Large 4 porte le mot « OPEN », qui n’est pas une licence.
L’écart entre les lignes de ce tableau n’est pas théorique. Apache 2.0 autorise l’usage commercial, la modification et la redistribution sans contrepartie. CC BY-NC 4.0, que Mistral applique à son modèle de synthèse vocale, interdit purement et simplement l’usage commercial. Les deux sont, dans le langage courant, des modèles « ouverts ».
Ce que Mistral écrit sur sa propre page tarifaire
La question de l’auto-hébergement figure dans la foire aux questions de la page tarifaire de Mistral. La réponse de l’entreprise, citée intégralement :
« Yes, you can self-host our models anywhere. Open-weight models (e.g., Mistral 7B) are Apache 2.0 licensed for research/individual use; while commercial deployments require a Mistral license with separate terms for derivatives and production use. »
Soit : oui, vous pouvez auto-héberger nos modèles n’importe où ; les modèles à poids ouverts sont sous licence Apache 2.0 pour l’usage de recherche et individuel, tandis que les déploiements commerciaux exigent une licence Mistral assortie de conditions distinctes pour les dérivés et la mise en production.
Cette phrase appelle deux remarques, et il faut les faire toutes les deux.
La première est que la formulation de Mistral est juridiquement discutable : la licence Apache 2.0 n’est pas une licence « pour la recherche et l’usage individuel ». Elle autorise explicitement l’usage commercial, sans demander d’accord. Sur ce point, la page de Mistral décrit mal sa propre licence.
La seconde est plus importante pour un lecteur qui a une décision à prendre : quelle que soit la lecture juridique, c’est bien l’entreprise elle-même qui écrit, sur sa page commerciale, qu’un déploiement commercial passe par une licence Mistral séparée. Pour une direction informatique qui envisage d’installer Large 4 sur ses serveurs, c’est cette phrase qui sera lue par le service juridique, pas l’exégèse d’Apache 2.0.
Pourquoi le record à 82 % ne dit pas ce qu’on croit
Mistral revendique un résultat remarquable en cybersécurité : 82 % sur une épreuve de l’indice Cyber d’Artificial Analysis qui demande au modèle de reproduire une faille réelle dans un logiciel open source, puis de la corriger. Mistral précise : « the highest of any model », le meilleur score de tous les modèles.
Le chiffre est exact. Mais l’explication se trouve dans l’annonce elle-même, deux paragraphes plus bas, et elle est décisive :
« Several leading closed models, including Claude Opus 5.5 and GPT-6 Astra, score near zero on the same test because they refuse to perform the task. »
Plusieurs grands modèles fermés obtiennent un score proche de zéro parce qu’ils refusent d’exécuter la tâche.
Le record n’oppose donc pas une compétence à une compétence. Il oppose un modèle qui accepte de reproduire une faille à des modèles qui refusent de le faire. C’est un écart de politique de modération autant qu’un écart de capacité.
Il faut immédiatement ajouter que l’argument de Mistral sur ce point est solide, et qu’il mérite d’être entendu : l’entreprise explique que défendre un logiciel commence souvent par prouver qu’une faille est réelle, et que les filtres des modèles fermés bloquent ce travail légitime. Elle ajoute que les attaquants, eux, contournent ces mêmes filtres. C’est un vrai problème de sécurité, documenté, et le choix de Mistral est défendable.
Mais « notre modèle est le meilleur du monde sur cette épreuve » et « notre modèle est le seul à accepter cette épreuve » ne sont pas la même phrase. Seule la seconde est complète.
Sur l’indice global, du reste, la formulation de Mistral est prudente et honnête : le modèle se classe « among the top five models globally » et mène « open-weight models developed outside China by a wide margin ». Développés hors de Chine. L’entreprise reconnaît donc elle-même que les modèles ouverts chinois sont devant.
La phrase sur les autorités d’État
C’est l’élément le moins repris de toute l’annonce, et c’est probablement le plus important. Il figure dans le paragraphe qui annonce le calendrier des poids :
« Until then, we are red-teaming the model in real-world settings with cybersecurity leaders, vetted partners, and state authorities, who will access the same model with reduced moderation and expanded cyber capabilities. »
En attendant, nous soumettons le modèle à des tests d’attaque en conditions réelles avec des acteurs majeurs de la cybersécurité, des partenaires sélectionnés, et des autorités d’État, qui accéderont au même modèle avec une modération réduite et des capacités cyber étendues.
Énonçons précisément ce que cela établit, et ce que cela n’établit pas.
Établi : des autorités étatiques disposent, avant tout le monde, d’une version du modèle dont les garde-fous sont abaissés et les capacités offensives élargies. Mistral l’écrit dans son annonce publique.
Non établi : de quels États il s’agit, selon quels critères ils sont retenus, sous quel contrôle, pour quelle durée, et si cet accès cesse à la publication des poids. L’annonce ne dit rien de tout cela, et nous n’avons trouvé aucune précision ailleurs.
Il n’y a là rien d’illégal, et rien de surprenant pour qui connaît le secteur de la cybersécurité : les agences nationales travaillent depuis longtemps avec des outils offensifs. Ce qui est notable, c’est la conjonction. Le même texte promet une publication ouverte pour tous et décrit un accès privilégié, à capacités étendues, pour des États non nommés. Les deux promesses coexistent dans le même paragraphe.
« Forgé en Europe » : d’où viennent les puces
L’annonce est catégorique : « ML4 was trained from scratch on 3,800 NVIDIA Grace Blackwell GPUs in Mistral’s own datacenters in Europe. » Entraîné de zéro sur 3 800 GPU Nvidia Grace Blackwell, dans les propres centres de données de Mistral, en Europe.
Les machines sont en Europe. Les puces, elles, sont conçues par Nvidia, entreprise américaine, et gravées à Taïwan. Il n’existe aujourd’hui aucune alternative européenne à cette étape, et ce n’est pas un reproche adressé à Mistral : c’est l’état de l’industrie. Mais cela délimite précisément ce que « souverain » peut signifier ici.
La souveraineté revendiquée est une souveraineté d’exploitation : les données sont traitées sur des machines détenues par Mistral, sur le sol européen, sous droit européen. L’annonce le formule d’ailleurs avec exactitude — « a European deployment that Mistral operates end-to-end, independently of other digital service providers and under European law ».
Ce n’est pas une souveraineté d’approvisionnement. Le modèle qui tourne aujourd’hui ne peut effectivement pas être débranché à distance. Le prochain, lui, dépendra de la disponibilité des puces suivantes, et donc de décisions prises à Santa Clara et à Washington.
Qui détient le champion européen
Puisque le mot « souveraineté » est au centre de l’annonce, le tour de table mérite d’être regardé. Le 8 septembre 2026, Mistral a annoncé une série D de 3 milliards d’euros, valorisant l’entreprise à plus de 21 milliards — le plus gros tour de table en capital jamais réalisé par une entreprise technologique européenne.
| Rôle | Investisseur | Origine |
|---|---|---|
| Chef de file série D | Samsung Electronics | Corée du Sud |
| Co-chefs de file | Scaleup Europe Fund (EQT), PSG Equity | Suède, États-Unis |
| Chef de file série C | ASML (environ 11 %) | Pays-Bas |
| Nouveaux entrants | Advent, BlackRock, Grand-Duché de Luxembourg | États-Unis, Luxembourg |
| Investisseurs historiques | a16z, General Catalyst, Lightspeed, Salesforce Ventures | États-Unis |
| Fournisseur de puces et actionnaire | Nvidia | États-Unis |
Le fait le plus notable de ce tableau est la dernière ligne. Nvidia fournit les 3 800 puces sur lesquelles le modèle a été entraîné, et figure parmi les investisseurs du tour de table. Le fournisseur unique du composant critique est aussi actionnaire du client.
Il faut être juste : cette configuration n’a rien de propre à Mistral, Nvidia étant au capital d’un grand nombre d’acteurs du secteur. Et une entreprise peut parfaitement être majoritairement financée par des capitaux étrangers tout en opérant sous droit européen — c’est même le cas de la plupart des champions technologiques du continent.
Mais lorsqu’une annonce s’intitule « Forgé en Europe, conçu pour la souveraineté de l’IA », le lecteur est fondé à savoir que le chef de file du dernier tour est coréen, que le premier actionnaire est néerlandais, et que le fournisseur des puces est également au capital.
Ajoutons un élément qui pèse dans le même sens : Mistral a conclu un partenariat stratégique avec Microsoft, aux termes duquel Microsoft utilise de la capacité des centres de données européens de Mistral pour servir ses propres clients, et intègre les modèles de Mistral à Microsoft Foundry et Copilot Studio. La relation va dans les deux sens.
« En Europe », pas « en France »
Un détail de formulation qui a été systématiquement perdu dans les reprises francophones. Mistral écrit « in Mistral’s own datacenters in Europe ». En Europe. Pas en France.
La nuance vient de l’entreprise, pas de nous, et elle correspond à sa réalité industrielle. Le premier centre de données de Mistral est bien français : Bruyères-le-Châtel, dans l’Essonne, 44 MW, équipé de 13 800 GPU Nvidia GB300 financés par une dette de 830 millions de dollars levée début 2026. Mais un second site, de 1,2 milliard d’euros, est en développement en Suède, et l’entreprise vise 200 MW de capacité européenne cumulée fin 2027.
L’annonce ne précise pas lequel de ces sites a servi à l’entraînement de Large 4. Affirmer que le modèle a été « entraîné en France » dépasse donc ce que Mistral a publié. C’est probable, compte tenu du calendrier des deux sites. Ce n’est pas établi.
Le prix affiché est un prix barré
La fiche technique officielle superpose deux tarifs. Le prix plein est barré, le prix de lancement est mis en avant.
| Par million de tokens | Prix plein | Prix de lancement |
|---|---|---|
| Entrée | 1,36 $ | 0,68 $ |
| Entrée mise en cache | 0,14 $ | 0,07 $ |
| Sortie | 4,18 $ | 2,09 $ |
Aucune date de fin n’est publiée pour cette promotion. Une entreprise qui calibre son budget sur 0,68 $ doit donc prévoir un doublement sans préavis.
Le second point est plus structurant. La page tarifaire de Mistral chiffre encore « Mistral Large » à 0,5 $ en entrée et 1,5 $ en sortie, soit les tarifs de la génération précédente. Le tarif plein de Large 4 représente donc environ 2,7 fois le prix d’entrée et 2,8 fois le prix de sortie de Mistral Large 3.
C’est une évolution qui va à rebours du mouvement général du secteur, où les prix à performance égale baissent de trimestre en trimestre. Elle s’explique : le modèle est beaucoup plus gros. Mais elle mérite d’être dite, car la couverture a présenté ces tarifs comme un argument de compétitivité alors qu’ils constituent, par rapport à la génération précédente de Mistral, une hausse.
Ce que notre classement mesure, au 8 octobre 2026
Le classement IA du Recul agrège des mesures issues de plusieurs familles de sources indépendantes. Au relevé du 8 octobre 2026, sur 9 380 mesures, « Mistral large 4 preview » y figure déjà.
Il faut lire ces rangs avec la prudence qu’ils imposent. L’évaluation du modèle y est encore marquée partial : elle ne repose que sur une seule famille de sources et sur une couverture de 44 sur l’indice généraliste. Un modèle sorti depuis trois jours n’a pas encore été mesuré par tout le monde, et son rang bougera.
- Généraliste : 352e sur 1 050 entrées, score 59,13, évaluation partielle.
- Coût-performance : 302e sur 1 042 entrées, score 71,97, couverture complète.
Un point, en revanche, ne dépend d’aucune mesure et ne bougera pas avant la fin du mois : Mistral Large 4 n’apparaît pas dans notre catégorie « open source ». Les quatre modèles Mistral qui y figurent sont des Small et des 7B. C’est la conséquence mécanique du constat du début de cet article : ce qui est téléchargeable chez Mistral, ce n’est pas Large 4.
Ce qui n’est pas vérifiable : le « trois fois moins de puces »
Une comparaison circule abondamment depuis l’annonce : Mistral aurait entraîné son modèle avec trois fois moins de puces que les derniers modèles chinois. Nous avons cherché à la vérifier. Elle ne l’est pas.
Mistral publie son chiffre : 3 800 GPU Grace Blackwell. Mais aucun des grands laboratoires chinois de la génération actuelle — DeepSeek V4, Qwen 3.8, Kimi K3 — ne publie la taille de son cluster d’entraînement. Les seuls chiffres disponibles pour ces modèles concernent les besoins d’inférence, ce qui est une tout autre mesure.
Le seul cluster d’entraînement chinois publié à ce jour figure dans le rapport technique de DeepSeek-V3 : 2 048 GPU H800. Soit moins de puces que Mistral, d’une génération antérieure.
Comparer un chiffre publié à des chiffres qui ne le sont pas ne produit pas un rapport de trois. Cela ne veut pas dire que Mistral n’a pas été efficace — c’est même vraisemblable. Cela veut dire que personne ne peut l’établir publiquement aujourd’hui.
Ce que l’annonce établit, et ce qu’elle n’établit pas
Établi, et solide. Un modèle d’un millier de milliards de paramètres, 52 milliards actifs, un million de tokens de contexte, entraîné de zéro sur 3 800 puces en Europe par une entreprise européenne. Des résultats revendiqués de premier plan en cybersécurité, en finance et en droit. Un déploiement européen opéré de bout en bout sous droit européen. Des données d’entraînement couvrant plus de 160 langues, dont toutes les langues officielles de l’Union. C’est un accomplissement industriel réel, et le seul de cette ampleur en Europe.
Annoncé, mais pas encore livré. Les poids. La licence. La possibilité d’installer le modèle chez soi. Les trois sont promis pour la fin octobre 2026, et les trois sont, au 9 octobre, des cases vides dans la documentation de l’entreprise.
Non établi. Que le modèle ait été entraîné en France plutôt qu’ailleurs en Europe. Qu’il ait nécessité trois fois moins de puces que les modèles chinois. Que son record à 82 % traduise une supériorité technique plutôt qu’une politique de modération différente — l’annonce elle-même dit le contraire.
Ouvert, au sens propre. Quels États accèdent à la version à modération réduite, selon quels critères, et pour combien de temps.
Ce qu’il faut surveiller d’ici fin octobre
Trois éléments, et trois seulement, décideront de ce que valait cette annonce.
La licence. Si les poids sortent sous Apache 2.0, comme Large 3, la promesse est tenue au-delà de ce que l’on pouvait exiger. Si c’est une licence maison assortie de conditions de revenus, comme pour Medium 3.5, « ouvert » voudra dire autre chose. Si c’est une licence de recherche, cela voudra dire le contraire de ce que la plupart des lecteurs ont compris.
Le contenu du téléchargement. Des poids publiés ne sont pas nécessairement les poids servis par l’API. Il faudra vérifier si la version téléchargeable correspond au modèle testé, ou à une variante dont les capacités cyber — justement celles qui font son record — ont été réduites.
Le tarif. La promotion de lancement n’a pas de date de fin publiée. Son maintien, ou son expiration silencieuse, dira si le prix de référence est 0,68 $ ou 1,36 $.
Nous mettrons cet article à jour à chacune de ces trois échéances. En attendant, la formule qui résume le mieux l’état des lieux est celle de Mistral elle-même, dans sa propre documentation : coming soon.
Pour aller plus loin : nous avions documenté en août 2026 la stratégie de Mistral consistant à héberger un modèle chinois sur ses propres serveurs, et en juin 2026 ce que « souverain » signifie exactement quand Mistral équipe une banque. Sur le fond du sujet, nous avons expliqué pourquoi la Chine donne ses modèles gratuitement et analysé l’accusation de distillation visant Kimi K3. Enfin, l’AI Act impose depuis le 2 août 2026 des obligations de transparence qui concernent directement les modèles à poids ouverts. Les positions de tous ces modèles sont suivies dans notre classement IA.