Aller au contenu principal

Large 3, Medium 3.1 et Ministral 3

Mis à jour le 28 juillet 2026

Les Autres Piliers de la Gamme Généraliste

Mistral Small 4 est le modèle recommandé par défaut, mais un défaut n’est pas une règle universelle. Deux situations le mettent en difficulté, et elles se trouvent aux deux extrémités du spectre : les tâches qui exigent la puissance brute maximale, et celles qui doivent s’exécuter sur un appareil sans jamais passer par le réseau. C’est précisément l’espace que couvrent les trois autres généralistes de la gamme, que nous allons parcourir dans cet ordre.

Mistral Large 3 — Le Frontier Multimodal

Lancé en décembre 2025, Mistral Large 3 est le modèle le plus puissant de l’écosystème. Il compte 675 milliards de paramètres au total dont 41 milliards seulement sont activés à chaque token, grâce à l’architecture MoE déjà rencontrée avec Small 4 — un facteur d’activation bien plus généreux, qui explique à la fois la qualité et le coût. Il est multimodal nativement : le texte et les images entrent dans la même requête, sans passer par un service d’analyse d’image séparé. Et il appartient au tier Open, ce qui signifie que ses poids sont publiés sur Hugging Face.

Vous le choisirez pour le raisonnement complexe multi-étapes, celui où chaque détail compte et où une approximation en début de chaîne invalide toute la conclusion. Vous le choisirez aussi lorsque l’analyse porte conjointement sur du texte et sur des images — un graphique à interpréter, une capture d’écran d’interface à diagnostiquer, un schéma technique à traduire en spécification. Plus largement, il s’impose quand la qualité absolue prime sur le budget, ainsi que dans les travaux de recherche et d’expérimentation où la latence importe peu.

La contrepartie est claire : le coût d’inférence est plus élevé et les réponses arrivent plus lentement qu’avec Small 4. Pour la majorité des applications de production, Small 4 reste le meilleur compromis, et Large 3 se réserve aux fractions du flux qui le justifient réellement.

Mistral Medium 3.1 — Le Compromis Frontier

Sorti en août 2025, Mistral Medium 3.1 occupe la position intermédiaire. C’est un modèle multimodal frontier du tier Premier, accessible uniquement via l’API : ses poids ne sont pas publiés, et vous ne pouvez donc pas l’héberger vous-même.

Ce positionnement répond à un profil d’entreprise assez précis. Il s’agit d’équipes qui trouvent Small 4 un peu court sur leurs tâches les plus complexes, mais pour lesquelles la latence de Large 3 est incompatible avec un usage en production interactive. Elles ont besoin d’un support multimodal fiable en conditions réelles, et surtout d’un modèle entièrement managé par Mistral : aucun GPU à provisionner, aucune montée de version à orchestrer. Si votre contrainte principale est de livrer vite sans monter une équipe d’infrastructure, Medium 3.1 est le point d’équilibre de la gamme.

La Gamme Ministral 3 — L’Edge et l’Embarqué

Lancée en décembre 2025, la gamme Ministral 3 répond à un besoin qui ne cesse de croître : faire tourner un modèle performant directement sur l’appareil de l’utilisateur, sans appel réseau.

Elle se décline en trois tailles. Le Ministral 3 — 14B est le plus capable de la gamme edge : il gère le texte et la vision, rivalise sur les benchmarks avec des modèles bien plus lourds, et trouve sa place sur un serveur local ou un poste de travail puissant. Le Ministral 3 — 8B est le modèle d’équilibre, assez compact pour tourner sur un laptop moderne tout en restant capable sur la conversation, le résumé et la classification. Le Ministral 3 — 3B, enfin, est le format ultra-compact destiné aux appareils mobiles et à l’IoT ; malgré sa taille, il conserve des capacités multimodales, texte et vision.

L’intérêt de l’edge tient à une chaîne de conséquences plutôt qu’à un seul argument. Les données ne quittent jamais l’appareil, ce qui règle d’emblée la question de la confidentialité et simplifie considérablement la mise en conformité réglementaire. La réponse est instantanée puisqu’aucun aller-retour réseau n’a lieu, et l’application continue de fonctionner hors ligne. Aucune dépendance à un service cloud externe ne subsiste, ce qui est décisif pour un enjeu de souveraineté. Le coût, enfin, change de nature : une fois le modèle déployé, il n’y a plus de facturation à l’usage. Un technicien en intervention sur un site sans couverture réseau illustre bien l’ensemble de ces points à la fois.

Les trois Ministral sont disponibles en poids ouverts, au tier Open. Pour un usage local simple, Ollama et llama.cpp suffisent à démarrer en quelques minutes ; pour du serving optimisé en production, vous vous tournerez vers vLLM ou TensorRT-LLM. Les formats safetensors et GGUF sont tous deux publiés sur Hugging Face, le second étant celui que consomment les runtimes légers.

Récapitulatif : Quel Généraliste Choisir

BesoinModèle Recommandé
Usage général, meilleur rapport qualité/prixMistral Small 4
Qualité maximale, tâches complexesMistral Large 3
API managée, compromis performance/coûtMistral Medium 3.1
Déploiement local, laptop/serveurMinistral 3 — 14B ou 8B
Mobile, IoT, embarquéMinistral 3 — 3B

Points Clés à Retenir

  • Mistral Large 3 (675B/41B actifs) est le modèle frontier multimodal le plus puissant, en open source
  • Mistral Medium 3.1 est un compromis frontier accessible uniquement via API (tier Premier)
  • Ministral 3 décline trois tailles (3B, 8B, 14B) pour le déploiement edge et embarqué
  • Le choix entre ces modèles dépend du triptyque qualité / coût / contraintes de déploiement
  • Tous les modèles Open sont disponibles sur Hugging Face pour le self-hosting