Oggi annunciamo Mistral 3, la nuova generazione di modelli Mistral. Mistral 3 include tre modelli piccoli e densi all’avanguardia (14B, 8B e 3B) e Mistral Large 3, il nostro modello più capace finora: un modello Mixture of Experts sparso, addestrato con 41B parametri attivi e 675B parametri totali. Tutti i modelli sono rilasciati con licenza Apache 2.0. Rendere open source i nostri modelli in una varietà di formati compressi potenzia la community degli sviluppatori e porta l’AI nelle mani delle persone tramite l’intelligenza distribuita.
I modelli Ministral offrono il miglior rapporto prestazioni-costo della loro categoria. Allo stesso tempo, Mistral Large 3 entra tra i modelli open source di punta, fine-tuned per istruzioni.
Mistral Large 3: un modello open all’avanguardia


Mistral Large 3 è uno dei migliori modelli open weight permissivi al mondo, addestrato da zero su 3000 GPU H200 di NVIDIA. Mistral Large 3 è il primo modello Mixture of Experts di Mistral dalla serie seminale Mixtral e rappresenta un sostanziale passo avanti nel pretraining in Mistral. Dopo il post-training, il modello raggiunge la parità con i migliori modelli open-weight instruction-tuned sul mercato su prompt generali, dimostrando inoltre comprensione delle immagini e prestazioni ai vertici della categoria nelle conversazioni multilingue (ovvero non in inglese/cinese).
Mistral Large 3 debutta al n. 2 nella categoria dei modelli OSS non-reasoning (n. 6 tra i modelli OSS complessivi) nella classifica LMArena.

Rilasciamo sia la versione base sia quella instruction fine-tuned di Mistral Large 3 con licenza Apache 2.0, offrendo una solida base per ulteriori personalizzazioni nelle community enterprise e degli sviluppatori. Una versione reasoning arriverà presto.
Mistral, NVIDIA, vLLM e Red Hat uniscono le forze per offrire Mistral 3 più veloce e più accessibile
In collaborazione con vLLM e Red Hat, Mistral Large 3 è altamente accessibile alla community open source. Rilasciamo un checkpoint in formato NVFP4, realizzato con llm-compressor. Questo checkpoint ottimizzato consente di eseguire Mistral Large 3 in modo efficiente su sistemi Blackwell NVL72 e su un singolo nodo 8×A100 o 8×H100 utilizzando vLLM.
Realizzare modelli AI open source avanzati richiede un’ottimizzazione ampia, ottenuta tramite una partnership con NVIDIA. Tutti i nostri nuovi modelli Mistral 3, da Large 3 a Ministral 3, sono stati addestrati su GPU NVIDIA Hopper per sfruttare la memoria HBM3e ad alta larghezza di banda per carichi di lavoro all’avanguardia su larga scala. L’approccio di co-design estremo di NVIDIA integra hardware, software e modelli. Gli ingegneri NVIDIA hanno abilitato un supporto efficiente all’inferenza per TensorRT-LLM e SGLang per l’intera famiglia Mistral 3, favorendo un’esecuzione efficiente a bassa precisione.
Per l’architettura MoE sparsa di Large 3, NVIDIA ha integrato kernel di attention e MoE Blackwell all’avanguardia, aggiunto il supporto per il serving disaggregato prefill/decode e collaborato con Mistral sul decoding speculativo, consentendo agli sviluppatori di servire in modo efficiente carichi di lavoro a contesto lungo e throughput elevato su GB200 NVL72 e oltre. Per l’edge, offre deployment ottimizzati dei modelli Ministral su DGX Spark, PC e laptop RTX e dispositivi Jetson, fornendo agli sviluppatori un percorso coerente e ad alte prestazioni per eseguire questi modelli open dal data center al robot.
Siamo molto grati per la collaborazione e desideriamo ringraziare in particolare vLLM, Red Hat e NVIDIA.
Ministral 3: intelligence all’avanguardia all’edge

Per casi d’uso edge e locali, rilasciamo la serie Ministral 3, disponibile in tre dimensioni di modello: 3B, 8B e 14B parametri. Inoltre, per ogni dimensione di modello, rilasciamo alla community varianti base, instruct e reasoning, ciascuna con capacità di comprensione delle immagini, tutte con licenza Apache 2.0. In combinazione con le capacità multimodali e multilingue native dei modelli, la famiglia Ministral 3 offre un modello per ogni esigenza enterprise o degli sviluppatori.
Inoltre, Ministral 3 raggiunge il miglior rapporto costo-prestazioni tra tutti i modelli OSS. Nei casi d’uso reali, il numero di token generati e la dimensione del modello contano allo stesso modo. I modelli instruct Ministral eguagliano o superano le prestazioni di modelli comparabili, producendo spesso un ordine di grandezza di token in meno.
Negli scenari in cui l’accuratezza è l’unica priorità, le varianti reasoning Ministral possono ragionare più a lungo per produrre un’accuratezza all’avanguardia nella loro classe di peso, ad esempio l’85% su AIME ‘25 con la nostra variante 14B.
Disponibile da oggi
Mistral 3 è disponibile da oggi su Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face (Large 3 e Ministral), Modal, IBM WatsonX, OpenRouter, Fireworks, Unsloth AI e Together AI. Inoltre, arriverà presto su NVIDIA NIM e AWS SageMaker.
Un’ultima cosa… personalizzazione con Mistral AI
Per le organizzazioni alla ricerca di soluzioni AI su misura, Mistral AI offre servizi di addestramento di modelli personalizzati per effettuare fine-tuning o adattare completamente i nostri modelli alle vostre esigenze specifiche. Che si tratti di ottimizzare task specifici di dominio, migliorare le prestazioni su dataset proprietari o distribuire modelli in ambienti unici, il nostro Team collabora con voi per creare sistemi AI allineati ai vostri obiettivi. Per deployment di livello enterprise, l’addestramento personalizzato garantisce che la vostra soluzione AI produca il massimo impatto in modo sicuro, efficiente e su larga scala.
Iniziare con Mistral 3
Il futuro dell’AI è open. Mistral 3 ridefinisce ciò che è possibile con una famiglia di modelli costruita per intelligence all’avanguardia, flessibilità multimodale e personalizzazione senza pari. Che stiate distribuendo soluzioni ottimizzate per l’edge con Ministral 3 o spingendo i confini del reasoning con Mistral Large 3, questa release mette l’AI all’avanguardia direttamente a vostra disposizione.
Perché Mistral 3?
Prestazioni all’avanguardia, accesso open: ottenete risultati al livello del closed-source con la trasparenza e il controllo dei modelli open source.
Multimodale e multilingue: create applicazioni che comprendono testo, immagini e logica complessa in oltre 40 lingue native.
Efficienza scalabile: da 3B a 675B parametri, scegliete il modello adatto alle vostre esigenze, dai dispositivi edge ai workflow enterprise.
Agentico e adattabile: effettuate deployment per coding, collaborazione creativa, analisi di documenti o workflow di utilizzo di strumenti con precisione.
Prossimi passi
Esplorate la documentazione del modello:
La documentazione tecnica per i clienti è disponibile nel nostro AI Governance Hub
Iniziate a creare: Ministral 3 e Large 3 su Hugging Face, oppure effettuate il deployment tramite la piattaforma Mistral AI per accesso API immediato e prezzi API
Personalizzate in base alle vostre esigenze: serve una soluzione su misura? Contattate il nostro Team per esplorare fine-tuning o training di livello enterprise.
Condividete con noi i vostri progetti, le vostre domande o i vostri breakthrough: Twitter/X, Discord o GitHub.
Insieme a questo lancio, potete esplorare tutti i dettagli dell’architettura della serie Ministral 3 nel nostro ultimo research paper qui.
Crediamo che il futuro dell’AI debba fondarsi su trasparenza, accessibilità e progresso collettivo. Con questa release, invitiamo il mondo a esplorare, creare e innovare con noi, sbloccando nuove possibilità nel reasoning, nell’efficienza e nelle applicazioni reali.
Insieme, trasformiamo la comprensione in azione.





