En bref
- Mistral dévoile ML4, modèle «open weight» conçu en Europe, testable avant publication le 27 octobre
- Avec 1000 milliards de paramètres, il analyse textes et images et a été entraîné deux mois sur plus de 160 langues
- Mistral met en avant la cyberdéfense; Artificial Analysis le juge au-dessus de la moyenne, avec un score de 38 contre 26
L'entreprise française Mistral a dévoilé mardi son nouveau modèle d'intelligence artificielle, avec lequel elle espère revenir dans la course face aux principaux acteurs du secteur, américains et chinois, à l'origine de ChatGPT, Claude ou DeepSeek.
Baptisé Mistral Large 4 (ML4) et surnommé le «Chonk» (dodu), il s'agit d'un modèle dit open weight, c'est-à-dire que ses paramètres et son architecture seront rendus publics. L'opération devait donner à la jeune pousse française l'élan pour continuer à exister dans une course mondiale à l'IA de plus en plus concurrentielle et coûteuse.
Un modèle open source
En l'état, toutes les IA les plus avancées sont américaines ou chinoises, qu'il s'agisse des modèles dits ouverts (open source ou open weight) c'est-à-dire gratuits, téléchargeables et modifiables, ou des versions fermées (non modifiables), à savoir celles d'Anthropic, OpenAI ou Google.
Mistral affirme dans un communiqué que son modèle se classe «parmi les meilleurs» du genre en matière de performances. Pour l'heure, il peut être testé sur Mistral Studio et ses paramètres doivent être publiés le 27 octobre.
D'ici là, l'entreprise entend travailler «avec les développeurs, spécialistes de la cybersécurité et autorités publiques» afin «d'évaluer plus en détail les capacités et le comportement» du modèle en conditions réelles. «Celui-là a demandé pas mal de travail préparatoire. Il a été entraîné et déployé sur notre propre infrastructure de calcul, et l'apprentissage par renforcement ne montre aucun signe d'essoufflement», a affirmé sur X le patron de Mistral, Arthur Mensch.
Conçu en Europe, ML4 peut analyser du texte et des images, avec 1000 milliards de paramètres, et a été entraîné pendant deux mois dans les centres européens de Mistral et sur plus de 160 langues, détaille le communiqué.
La ministre déléguée au Numérique, Anne Le Hénanff, a vanté sur X «une nouvelle démonstration de ce que l'écosystème français de l'IA sait faire». «Fière de voir l'innovation française continuer d'avancer et de compter dans la course mondiale», a-t-elle ajouté.
Un modèle très performant pour la cyberdéfense
L'entreprise, lancée en 2023, met particulièrement en avant ses performances en matière de cybersécurité, qui doivent permettre, «aux entreprises et aux gouvernements de se défendre contre les acteurs malveillants» qui contournent les protections des modèles fermés pour mener des cyberattaques, selon le cofondateur Guillaume Lample.
Les entreprises et les Etats «ne devraient pas avoir à dépendre d'un fournisseur de modèles fermés susceptible de désactiver arbitrairement leurs capacités de cyberdéfense», ajoute le communiqué. Selon l'entreprise, le modèle est «à la pointe de la technologie» parmi les modèles open weight en matière notamment de «cyberdéfense» et de «tâches liées à l'industrie et à la finance». L'entreprise a publié des résultats de référence préliminaires et affirme que le modèle doit encore progresser dans plusieurs domaines.
Selon le site indépendant Artificial Analysis, la version de prévisualisation de Mistral Large 4 affiche des performances supérieures à la moyenne des modèles du marché. Le modèle obtient un score de 38 à son indice de référence, contre une médiane de 26. Le modèle affiche une vitesse de génération supérieure à la moyenne du secteur et un coût d'utilisation jugé compétitif par rapport à d'autres modèles de performances comparables.
Cette annonce intervient moins d'un mois après une levée de fonds de 3 milliards d'euros qui a valorisé Mistral à plus de 21 milliards d'euros. Celle-ci reste toutefois modeste comparée aux géants américains du secteur puisque OpenAI, créateur de ChatGPT, a par exemple levé en début d'année 122 milliards de dollars. Ces deux sociétés ont aussi dévoilé des modèles d'IA si puissants que leurs versions grand public nécessitent d'être bridées au vu des risques de sécurité.