Mistral Large 4 : un modèle européen de 1 000 milliards de paramètres, aux poids bientôt ouverts
Mistral a présenté le 6 octobre Mistral Large 4 (surnommé « Le Chonk »), son plus gros modèle, entraîné de zéro dans ses propres centres de données européens.
Ce qui est annoncé
- Architecture mixture-of-experts : environ 1 000 milliards de paramètres au total, une cinquantaine de milliards actifs par requête.
- Multimodal (entrée image) et plus de 160 langues, dont toutes les langues officielles de l'UE.
- Entraînement sur environ 4 000 GPU Nvidia Grace Blackwell pendant deux mois.
- Mistral le présente comme le meilleur modèle à poids ouverts développé hors de Chine. C'est une affirmation du constructeur, sur des benchmarks agrégés : à vérifier de façon indépendante.
Accès et prix
| | Détail | |---|---| | API | préversion limitée sur Mistral Studio | | Prix de liste | 1,36 $ en entrée / 4,18 $ en sortie par million de tokens | | Prix pendant la préversion | moitié moins (0,68 $ / 2,09 $) | | Poids | publication annoncée le 27 octobre |
Le point à surveiller : la licence
Large 3 était sous Apache 2.0. Pour Large 4, la presse rapporte une licence Mistral personnalisée dont les termes ne sont pas publiés. « Poids ouverts » ne veut pas dire « open source » : avant de bâtir un produit dessus, lisez les conditions d'usage commercial, de redistribution et de fine-tuning.
Ce que ça change pour l'auto-hébergement
Un modèle de ~1 T de paramètres, même avec ~49 B actifs, reste hors de portée d'un VPS ou d'un GPU unique : il faut charger tous les experts en mémoire. Pour la plupart des équipes, l'intérêt sera l'API européenne (données hébergées en Europe, argument de souveraineté) plutôt que l'hébergement local. Les variantes plus petites éventuelles de la famille seront probablement plus utiles aux homelabs.
À retenir : prix API compétitif, mais attendez le 27 octobre pour juger licence, poids et résultats indépendants.
Sources : TechCrunch, SiliconANGLE, Quartz, TechXplore, Beam AI.