Connu sous le nom de « Le Chonk », le modèle à 1 000 milliards de paramètres de la société avec 49 milliards de paramètres actifs a été publié hier en avant-première publique.
La société française d’IA Mistral a annoncé son nouveau modèle d’IA à poids ouvert Mistral Large 4 (ML4), qui, selon elle, « surclasse considérablement » tout modèle à poids ouvert développé aux États-Unis ou en Europe.
Connu sous le nom de « Le Chonk », ML4 est un modèle multimodal natif à 1 000 milliards de paramètres avec 49 milliards de paramètres actifs, et le « modèle le plus grand et le plus performant à ce jour » de Mistral.
ML4, lancé hier (6 octobre) en avant-première publique, a été formé sur 3 800 GPU Nvidia Grace Blackwell dans les propres centres de données de l'entreprise en Europe. Une « part significative » des données de formation du modèle était multilingue, couvrant plus de 160 langues, y compris toutes les langues officielles de l'UE.
Mistral – qui a levé 3 milliards d'euros en financement de série D pour une valorisation post-money de plus de 21 milliards d'euros le mois dernier – a affirmé que ML4 maîtrise les charges de travail critiques de l'entreprise telles que la finance, le droit et en particulier la cybersécurité.
Selon la société, ML4 se classe parmi les cinq meilleurs modèles au monde et est en tête des modèles ouverts développés en dehors de la Chine par « une large marge » sur l’Artificial Analysis Cyber Index, une évaluation indépendante de la façon dont les modèles d’IA trouvent et corrigent les failles de sécurité dans les logiciels.
Mistral a déclaré que lors de l'un des tests de l'indice, qui demande à un modèle de reproduire une vulnérabilité réelle dans un logiciel open source puis de la corriger, ML4 a obtenu le score le plus élevé de tous les modèles, avec 82 %.
La société a déclaré dans un article de blog que le score élevé du modèle à ces tests reflétait un « avantage pratique ».
« Plusieurs modèles fermés de premier plan, dont Claude Opus 5.5 et GPT-6 Astra, obtiennent un score proche de zéro au même test parce qu'ils refusent d'accomplir la tâche », a déclaré Mistral. « Pourtant, la défense des logiciels commence souvent par prouver qu’une faille est réelle, exactement le type de filtres de sécurité au travail dans les modèles fermés qui peuvent bloquer.
« Cela est d'autant plus important que les acteurs malveillants jailbreakent de plus en plus ces mêmes modèles pour soutenir des cyberactivités offensives. Les défenseurs ont besoin de systèmes capables de correspondre à ces capacités sans être contraints par les mêmes refus. »
Mistral a également déclaré que ML4 fonctionnait bien en matière de codage agent, atteignant même un score plus élevé dans les références du secteur que certains concurrents chinois.
Les poids du modèle seront publiés d'ici la fin du mois, selon le blog, tandis que la société recueillera les commentaires de l'aperçu au cours des prochaines semaines.
La révélation du Chonk par Mistral marque une poussée en faveur de la souveraineté européenne dans une course mondiale de plus en plus compétitive pour la domination de l'IA – les modèles à poids ouvert devenant un sujet important dans le secteur. Le poids ouvert signifie que les paramètres d'un modèle peuvent être téléchargés et exécutés par n'importe qui.
Les sociétés chinoises d'IA ont été à l'avant-garde des efforts d'ouverture, tandis que nombre de leurs rivaux américains ont gardé fermés leurs systèmes les plus avancés.
En juillet, le PDG d'Anthropic, Dario Amodei, a répliqué aux affirmations de son entreprise souhaitant l'interdiction des modèles chinois à poids ouvert, écrivant qu'« Anthropic n'a jamais plaidé en faveur d'une interdiction des modèles à poids ouvert », et a déclaré que de tels modèles sans capacités dangereuses sont un bien public qui ne coûte rien au-delà du calcul nécessaire à leur fonctionnement.
