Mistral AI dévoile Mistral Large 4, son nouveau modèle phare, pour revenir dans la course mondiale à l’IA
Le laboratoire français veut réduire l'écart avec les modèles américains et chinois, en misant sur la cybersécurité, la souveraineté européenne et un déploiement avec peu de GPU.

Mistral AI a dévoilé mardi 6 octobre Mistral Large 4 (ML4), surnommé « Le Chonk », son nouveau modèle phare multimodal doté de capacités agentiques. Le laboratoire français veut ainsi réduire son retard sur les modèles américains et chinois et revenir dans la course mondiale à l’IA.
Un calendrier en deux temps
ML4, qui traite notamment du texte et des images, est accessible mardi en avant-première sur l’API de Mistral. Ses poids seront publiés le 27 octobre en « open-weight », avec des versions quantifiées en FP8 et FP4, déployables sur 4 à 8 GPU Nvidia B200 ou B300. Ce format permet aux entreprises de récupérer les poids du modèle et de l’héberger sur leurs propres infrastructures, sans rendre publics les données et la méthode d’entraînement. Dans les prochaines semaines, après une phase de tests A/B, il deviendra le modèle par défaut de tous les produits de Mistral, dont Vibe.
La cybersécurité au centre
Mistral met en avant la cybersécurité parmi les usages du modèle : les entreprises pourront développer leurs propres outils de défense contre les cyberattaques, sans dépendre entièrement de modèles fermés. Guillaume Lample, cofondateur de Mistral AI, estime que la plupart des entreprises sont vulnérables et que les modèles fermés posent parfois des problèmes d’accès. Le PDG, Arthur Mensch, a affirmé lors d’une conférence à Abou Dhabi que ML4 est « supérieur aux modèles chinois sur certains aspects », notamment en cybersécurité. ML4 doit aussi servir à concevoir des objets en 3D pour l’industrie, synthétiser de grands volumes de documents, aider les développeurs à coder et identifier des objets dans des images satellites ou aériennes.
Entraîné sur 4.000 GPU Nvidia en Europe
Le modèle a été entraîné pendant deux mois sur 4.000 GPU Nvidia Grace Blackwell, installés dans les centres de données européens de Mistral. Cette puissance reste loin de celle des acteurs américains. Guillaume Lample souligne que le modèle a été conçu pour être déployable avec une configuration minimale. Mistral ambitionne de disposer d’un gigawatt de puissance de calcul d’ici 2030.
Après une levée de 3 milliards d’euros
La sortie intervient quelques semaines après la série D de 3 milliards d’euros bouclée en septembre, avec un tour de table mené par Samsung. Mistral présente ML4 comme la première étape de la feuille de route financée par cette levée. Elle met en avant sa région souveraine européenne, où les données des clients restent sous juridiction de l’Union européenne.
Une remontada à confirmer
Ces derniers mois, les modèles de Mistral n’occupaient plus les toutes premières places des principaux classements, dominés par OpenAI, Anthropic, Google et plusieurs laboratoires chinois. Dans son communiqué, Mistral revendique pour ML4 la meilleure performance enregistrée par un modèle à poids ouverts sur le benchmark Legal Agent de Harvey, ainsi que de bons résultats dans la finance et l’industrie. L’entreprise précise qu’elle reçoit encore les résultats définitifs de plusieurs benchmarks et que le modèle continuera de progresser grâce à une nouvelle phase d’apprentissage.



