Mistral a annoncé Mistral Large 4, son nouveau modèle phare surnommé « Le Chonk », dont les poids complets doivent être rendus publics le 27 octobre. L’entreprise française a dévoilé le modèle lors d’une conférence à Abou Dhabi le 6 octobre et accorde, d’ici là, un accès anticipé limité à des spécialistes de la cybersécurité et à des organismes publics, selon Reuters et le Wall Street Journal.

Cette chronologie est essentielle : Large 4 n’est pas encore un modèle disponible publiquement dans des conditions normales. Les développeurs ne peuvent pas encore télécharger ses poids définitifs, consulter une fiche technique complète du modèle ni reproduire les affirmations de Mistral sur ses performances et sa sécurité. L’événement du jour est donc une annonce assortie d’un accès contrôlé ; l’étape réellement fondée sur des poids ouverts est attendue plus tard dans le mois.

Les informations publiées par des médias indépendants décrivent Large 4 comme un modèle multimodal à architecture de mélange d’experts (MoE), comptant environ 1 000 milliards de paramètres au total, dont près de 49 milliards actifs par token. Axios indique que Mistral l’a entraîné pendant environ deux mois sur 4 000 GPU Nvidia Grace Blackwell dans ses centres de données européens. Le Wall Street Journal fait également état d’un entraînement sur 4 000 GPU. Une telle architecture augmenterait fortement la capacité totale par rapport à la génération précédente de Mistral tout en n’activant qu’une fraction des paramètres à l’inférence, afin d’éviter le coût d’un modèle dense de 1 000 milliards de paramètres à chaque token.

Mistral présente Large 4 comme une alternative haut de gamme à poids ouverts aux systèmes fermés américains et aux modèles ouverts chinois devenus très compétitifs. Reuters rapporte que l’entreprise revendique notamment de fortes performances en cybersécurité ainsi que des capacités en programmation, finance, analyse géospatiale et conception de puces. Mistral affirme également que ses mécanismes de confinement ont résisté à des tentatives visant à faire sortir le modèle de son environnement de test. Ces éléments restent des déclarations de l’entreprise relayées par la presse, et non des résultats de benchmarks ou de tests de sécurité reproduits de manière indépendante.

Pour les organisations qui envisagent une IA souveraine ou auto-hébergée, l’enjeu opérationnel pourrait être important. Un modèle européen performant dont les poids sont accessibles peut donner aux entreprises et administrations davantage de maîtrise sur le lieu d’exécution, l’inspection du modèle et le choix de l’infrastructure. Mais l’ouverture des poids ne signifie pas un faible coût : 49 milliards de paramètres actifs exigeraient toujours une quantité importante de mémoire d’accélérateur, des interconnexions rapides et une ingénierie d’inférence sérieuse pour une exploitation en production.

L’intérêt principal de Large 4 ne réside donc pas encore dans un classement de benchmark, mais dans la frontière de contrôle qu’il pourrait déplacer. Si Mistral publie les poids promis le 27 octobre avec des conditions permettant un déploiement réel, les équipes pourront tester le modèle sur leur propre code, leurs propres données et leurs propres scénarios de sécurité, plutôt que de se fier à des démonstrations du fournisseur. D’ici là, les comparaisons avec les autres modèles ouverts de pointe restent provisoires.

Au moment de cette vérification, le site d’actualité officiel de Mistral ne contenait pas encore d’article ni de fiche technique consacrés à Large 4. Reuters, le Wall Street Journal et Axios ont cependant rapporté séparément l’annonce et des informations de lancement globalement concordantes. La licence exacte, les fichiers téléchargeables et un ensemble de benchmarks reproductibles devront être vérifiés lorsque les poids publics seront effectivement disponibles.

Références