Recherche

Présentation de Mistral 3

December 2, 2025

By Mistral AI

Aujourd’hui, nous annonçons Mistral 3, la nouvelle génération de modèles Mistral. Mistral 3 comprend trois petits modèles denses de pointe (14B, 8B et 3B) ainsi que Mistral Large 3, notre modèle le plus performant à ce jour, un modèle sparse Mixture of Experts entraîné avec 41B paramètres actifs et 675B paramètres au total. Tous les modèles sont publiés sous licence Apache 2.0. La publication de nos modèles en open source, dans plusieurs formats compressés, donne plus de moyens à la communauté des développeurs et met l’IA entre les mains de chacun grâce à l’intelligence distribuée.

Les modèles Ministral offrent le meilleur rapport performances-coût de leur catégorie. Dans le même temps, Mistral Large 3 rejoint les modèles open source de pointe ayant fait l’objet d’un fine-tuning d’instructions.

Mistral Large 3 : un modèle ouvert de pointe

Chart Base Models (1)

3 Model Performance Comparison (instruct)

Mistral Large 3 compte parmi les meilleurs modèles à poids ouverts et sous licence permissive au monde. Il a été entraîné à partir de zéro sur 3000 GPU NVIDIA H200. Mistral Large 3 est le premier modèle Mixture of Experts de Mistral depuis la série fondatrice Mixtral, et marque une avancée importante dans le pré-entraînement chez Mistral. Après post-entraînement, le modèle atteint un niveau équivalent aux meilleurs modèles à poids ouverts entraînés sur instructions du marché pour les prompts généraux, tout en démontrant une compréhension des images et des performances de référence pour les conversations multilingues (c’est-à-dire dans les langues autres que l’anglais et le chinois).

Mistral Large 3 entre à la 2e place de la catégorie des modèles OSS sans raisonnement (6e parmi l’ensemble des modèles OSS) dans le classement LMArena.

Lm Arena Chart Ml3

Nous publions les versions de base et les versions ayant fait l’objet d’un fine-tuning d’instructions de Mistral Large 3 sous licence Apache 2.0. Elles offrent une base solide pour de nouvelles personnalisations dans les entreprises et les communautés de développeurs. Une version de raisonnement arrivera prochainement. 

Mistral, NVIDIA, vLLM et Red Hat s’associent pour rendre Mistral 3 plus rapide et plus accessible

Avec vLLM et Red Hat, Mistral Large 3 est très accessible à la communauté open source. Nous publions un checkpoint au format NVFP4, construit avec llm-compressor. Ce checkpoint optimisé vous permet d’exécuter Mistral Large 3 efficacement sur des systèmes Blackwell NVL72 et sur un seul nœud 8×A100 ou 8×H100 avec vLLM.

Fournir des modèles d’IA open source avancés nécessite une optimisation étendue, rendue possible par un partenariat avec NVIDIA. Tous nos nouveaux modèles Mistral 3, de Large 3 à Ministral 3, ont été entraînés sur des GPU NVIDIA Hopper pour utiliser la mémoire HBM3e à haute bande passante dans des charges de travail à très grande échelle. L’approche de co-conception poussée de NVIDIA réunit matériel, logiciel et modèles. Les ingénieurs NVIDIA ont permis une prise en charge de l’inférence efficace pour TensorRT-LLM et SGLang sur toute la famille Mistral 3, avec une exécution efficace en basse précision.

Pour l’architecture MoE sparse de Large 3, NVIDIA a intégré des kernels Blackwell de pointe pour l’attention et le MoE, ajouté la prise en charge du serving désagrégé prefill/decode, et collaboré avec Mistral sur le décodage spéculatif. Les développeurs peuvent ainsi servir efficacement des charges de travail à contexte long et à haut débit sur GB200 NVL72 et au-delà. En périphérie, NVIDIA fournit des déploiements optimisés des modèles Ministral sur DGX Spark, PC et ordinateurs portables RTX et appareils Jetson, afin de donner aux développeurs une voie cohérente et performante pour exécuter ces modèles ouverts, du data center au robot.

Nous sommes très reconnaissants pour cette collaboration et tenons à remercier particulièrement vLLM, Red Hat et NVIDIA.

Ministral 3 : une intelligence de pointe en périphérie

4 Gpqa Diamond Accuracy

Pour les cas d’usage edge et locaux, nous publions la série Ministral 3, disponible en trois tailles de modèles : 3B, 8B et 14B paramètres. De plus, pour chaque taille de modèle, nous publions pour la communauté des variantes base, instruct et reasoning, chacune dotée de capacités de compréhension des images, toutes sous licence Apache 2.0. Associée aux capacités multimodales et multilingues natives des modèles, la famille Ministral 3 propose un modèle adapté à chaque besoin d’entreprise ou de développement.

Par ailleurs, Ministral 3 atteint le meilleur rapport coût-performance de tous les modèles OSS. Dans les cas d’usage réels, le nombre de tokens générés et la taille du modèle comptent autant l’un que l’autre. Les modèles instruct Ministral égalent ou dépassent les performances de modèles comparables, tout en produisant souvent dix fois moins de tokens. 

Pour les environnements où seule la précision compte, les variantes reasoning de Ministral peuvent raisonner plus longtemps afin d’atteindre une précision de pointe dans leur catégorie de taille, par exemple 85 % sur AIME ‘25 avec notre variante 14B.

 

 

 

Disponible dès aujourd’hui

Mistral 3 est disponible dès aujourd’hui sur Mistral AI StudioAmazon Bedrock, Azure Foundry, Hugging Face (Large 3 et Ministral), Modal, IBM WatsonX, OpenRouter, Fireworks, Unsloth AI et Together AI. Il sera également disponible prochainement sur NVIDIA NIM et AWS SageMaker.

Encore un point… la personnalisation avec Mistral AI

Pour les organisations qui recherchent des solutions d’IA sur mesure, Mistral AI propose des services d’entraînement de modèles personnalisés pour effectuer un fine-tuning ou adapter entièrement nos modèles à vos besoins spécifiques. Qu’il s’agisse d’optimiser des tâches propres à un domaine, d’améliorer les performances sur des jeux de données propriétaires ou de déployer des modèles dans des environnements spécifiques, notre équipe collabore avec vous pour construire des systèmes d’IA alignés sur vos objectifs. Pour les déploiements de niveau entreprise, l’entraînement personnalisé garantit une solution d’IA sûre, efficace et adaptée au passage à l’échelle.

Démarrer avec Mistral 3

L’avenir de l’IA est ouvert. Mistral 3 redéfinit ce qu’une famille de modèles peut apporter : intelligence de pointe, flexibilité multimodale et personnalisation avancée. Que vous déployiez des solutions optimisées pour la périphérie avec Ministral 3 ou que vous repoussiez les limites du raisonnement avec Mistral Large 3, cette version met une IA de pointe directement entre vos mains.

Pourquoi Mistral 3 ?

  • Performances de pointe, accès ouvert : obtenez des résultats de niveau modèle propriétaire, avec la transparence et le contrôle des modèles open source.

  • Multimodal et multilingue : créez des applications qui comprennent le texte, les images et la logique complexe dans plus de 40 langues natives.

  • Efficacité à grande échelle : de 3B à 675B paramètres, choisissez le modèle adapté à vos besoins, des appareils en périphérie aux workflows d’entreprise.

  • Agentique et adaptable : déployez des workflows de code, de collaboration créative, d’analyse de documents ou d’utilisation d’outils avec précision.

Étapes suivantes

  1. Consultez la documentation des modèles : 

  2. La documentation technique destinée aux clients est disponible sur notre AI Governance Hub

  3. Commencez à développer : Ministral 3 et Large 3 sur Hugging Face, ou déployez via la plateforme Mistral AI pour un accès API immédiat et les tarifs API

  4. Adaptez à vos besoins : besoin d’une solution sur mesure ? Contactez notre équipe pour explorer le fine-tuning ou l’entraînement de niveau entreprise.

  5. Partagez vos projets, questions ou avancées avec nous : Twitter/X, Discord ou GitHub.

En parallèle de ce lancement, vous pouvez consulter tous les détails de l’architecture de la série Ministral 3 dans notre dernier article de recherche ici.

Nous pensons que l’avenir de l’IA doit reposer sur la transparence, l’accessibilité et le progrès collectif. Avec cette version, nous lançons une Invitation au monde entier à explorer, construire et innover avec nous, pour ouvrir de nouvelles possibilités en raisonnement, en efficacité et en applications concrètes.

Ensemble, transformons la compréhension en action.

Mistral Large 3

Open

Open-weight, polyvalent, multimodal et multilingue.

Text-to-text

Multimodal

Input (/M tokens)

$0.5

Output (/M tokens)

$1.5

Ministral 3 (8B)

Open

Best-in-class frontier AI to the edge.

Text-to-text

Agentic

Lightweight

Input (/M tokens)

$0.15

Output (/M tokens)

$0.15