IA : Mistral tente de revenir dans la course avec son nouveau modèle
L'entreprise française Mistral a dévoilé mardi son nouveau modèle d'intelligence artificielle, avec lequel elle espère revenir dans la course face aux principaux acteurs du secteur, américains et chinois, à l'origine de ChatGPT, Claude ou DeepSeek.
Baptisé Mistral Large 4 (ML4) et surnommé le "Chonk" (dodu), il s'agit d'un modèle dit "open weight", c'est-à-dire que ses paramètres et son architecture seront rendus publics.
L'opération devait donner à la jeune pousse française l'élan pour continuer à exister dans une course mondiale à l'IA de plus en plus concurrentielle et coûteuse.
En l'état, toutes les IA les plus avancées sont américaines ou chinoises, qu'il s'agisse des modèles dits ouverts ("open source" ou "open weight") c'est-à-dire gratuits, téléchargeables et modifiables, ou des versions fermées (non modifiables), à savoir celles d'Anthropic, OpenAI ou Google.
Mistral affirme dans un communiqué que son modèle se classe "parmi les meilleurs" du genre en matière de performances.
Pour l'heure, il peut être testé sur Mistral Studio et ses paramètres doivent être publiés le 27 octobre.
D'ici là, l'entreprise entend travailler "avec les développeurs, spécialistes de la cybersécurité et autorités publiques" afin "d'évaluer plus en détail les capacités et le comportement" du modèle en conditions réelles.
"Celui-là a demandé pas mal de travail préparatoire. Il a été entraîné et déployé sur notre propre infrastructure de calcul, et l’apprentissage par renforcement ne montre aucun signe d’essoufflement", a affirmé sur X le patron de Mistral, Arthur Mensch.
- course mondiale à l'IA -
Conçu en Europe, ML4 peut analyser du texte et des images, avec 1.000 milliards de paramètres, et a été entraîné pendant deux mois dans les centres européens de Mistral et sur plus de 160 langues, détaille le communiqué.
L'entreprise, lancée en 2023, met particulièrement en avant ses performances en matière de cybersécurité, qui doivent permettre, "aux entreprises et aux gouvernements de se défendre contre les acteurs malveillants" qui contournent les protections des modèles fermés pour mener des cyberattaques, selon le cofondateur Guillaume Lample.
Les entreprises et les États "ne devraient pas avoir à dépendre d’un fournisseur de modèles fermés susceptible de désactiver arbitrairement leurs capacités de cyberdéfense", ajoute le communiqué.
Selon l'entreprise, le modèle est "à la pointe de la technologie" parmi les modèles open-weight en matière notamment de "cyberdéfense" et de "tâches liées à l’industrie et à la finance".
"Seul un écosystème ouvert peut garantir la sécurité de l'IA", avait déjà proné Arthur Mensch.
L'entreprise a publié des résultats de référence préliminaires et affirme que le modèle doit encore progresser dans plusieurs domaines.
L'opération devait donner à la jeune pousse française l'élan pour continuer à exister dans une course mondiale à l'IA de plus en plus concurrentielle et coûteuse.
Cette annonce intervient moins d'un mois après une levée de fonds de 3 milliards d'euros qui a valorisé Mistral à plus de 21 milliards d'euros.
Celle-ci reste toutefois modeste comparée aux géants américains du secteur puisque OpenAI, créateur de ChatGPT, a par exemple levé en début d'année 122 milliards de dollars. Ces deux sociétés ont aussi dévoilé des modèles d'IA si puissants que leurs versions grand public nécessitent d'être bridées au vu des risques de sécurité.
J.Dupont--JdCdC