Chez Mistral, le modèle n’est plus forcément Mistral

Deux bocaux géants remplis de cubes. À gauche, un dirigeant en pull bleu passe, satisfait, devant un bocal de cubes prune étiqueté « IA française ». À droite, une dirigeante en veste prune montre la contre-étiquette d’un bocal où se mélangent cubes prune et cubes bleus : « Origine : UE et hors UE ».

Depuis le 21 septembre, le mode programmation de l’assistant de Mistral propose par défaut un modèle conçu en Chine : GLM-5.3, de l’entreprise Z.ai. Selon le site Next, Mistral a précisé que le mode de tous les jours, celui qui sert à écrire ou à résumer, doit suivre1.

Vos requêtes ne partent pas chez Z.ai pour autant : Mistral fait tourner ce modèle, et Z.ai ne figure pas parmi ses sous-traitants2. L’épisode rappelle en revanche que, dans tous vos outils d’IA, le modèle qui vous répond peut changer, parfois sans que l’écran l’indique3. Votre méthode, c’est-à-dire les consignes que vous donnez et votre façon de juger une réponse, compte donc plus que le choix de l’outil.

Ce qui se passe chez Mistral

Mistral a ouvert cet été sa plateforme aux modèles d’autres laboratoires, en commençant par GLM4. C’est un modèle « ouvert » : son concepteur en publie les fichiers, et sa licence autorise d’autres entreprises à le faire tourner5. Mistral met en avant la capacité de GLM à traiter de très longs contenus et des limites d’usage généreuses ; il le facture aussi aux développeurs moins cher que son propre modèle phare6.

Les fournisseurs de cloud comme Microsoft, Amazon ou Google vendent depuis longtemps les modèles de leurs concurrents, chinois compris7. OpenAI et Anthropic, qui conçoivent leurs propres modèles comme Mistral, ne vendent que les leurs. Mistral se rapproche donc des premiers.

La concurrence dans l’IA porte aujourd’hui sur deux sujets : la puissance des modèles, et le contrôle des infrastructures où ils tournent. En annonçant une levée de 3 milliards d’euros en septembre, Mistral présentait la course au modèle le plus puissant comme la question de « la première vague » de l’IA générative, et ajoutait que ses clients s’interrogent désormais sur le contrôle8. Son PDG, Arthur Mensch, prévoyait dès janvier que les modèles allaient se banaliser9. Mistral garde un pied dans la course, puisque sa levée doit aussi financer la recherche et l’entraînement de ses modèles, mais il met surtout le contrôle en avant.

Accueillir les modèles des autres a une logique commerciale : Mistral garde ses clients même quand ils préfèrent un autre modèle que le sien, et il vend davantage de calcul ; Microsoft s’est d’ailleurs engagé en juillet à utiliser sa capacité pour plusieurs milliards de dollars10. Ce virage peut aussi traduire une difficulté : Mistral n’a sorti aucun nouveau modèle généraliste depuis le printemps, et le grand modèle promis par son PDG pour l’été, avec un accès anticipé pour des partenaires, n’était toujours pas public fin septembre11.

Ce que cela change pour votre entreprise

Le modèle que vous utilisez ne durera pas. Les modèles américains auxquels Z.ai comparait le sien en août avaient été remplacés un mois plus tard12. Une partie de la qualité de vos usages ne dépend pas du modèle et vous appartient : les consignes que vous donnez, les documents de référence que vous fournissez, et votre façon de juger une réponse. Une entreprise qui les a mis par écrit change d’outil sans tout reconstruire. Celle qui les a laissés dans la tête d’un collaborateur ou dans l’historique d’un outil repart de zéro.

Le nom de l’outil ne dit plus quel modèle vous répond. La documentation de Vibe, l’assistant qui a remplacé Le Chat, parle encore des « mêmes modèles Mistral » dans tous ses modes, alors que son mode programmation propose GLM par défaut13. Les plateformes mélangent désormais des modèles de plusieurs origines.

« Souverain » se vérifie sur deux plans : le tuyau et le modèle. Le tuyau désigne l’infrastructure qui fait tourner le modèle. Chez Mistral, elle est située en Europe par défaut, mais une partie est exploitée par Microsoft et Google, et deux fonctions de Vibe reposent sur des prestataires installés aux États-Unis : la recherche sur le web et la génération d’images2. Or une entreprise américaine doit répondre aux demandes de la justice de son pays, même pour des données stockées hors des États-Unis14. « Européen » décrit donc l’entreprise et l’adresse des serveurs, mais pas tous ceux qui les exploitent : tenez-en compte pour vos dossiers les plus sensibles (clients, personnel, stratégie).

Côté modèle, GLM est fourni sans modification : il répond comme Z.ai l’a entraîné, et en Chine, les services d’IA générative doivent respecter des règles de contenu fixées par l’État15. Ces règles pèsent peu sur un courrier commercial ou le résumé d’une réunion. Sur l’actualité internationale ou la politique, mieux vaut comparer avec un autre outil. Et si vous travaillez pour de grands comptes ou pour le secteur public, vérifiez que vos contrats n’encadrent pas l’origine des outils d’IA que vous utilisez.

Prévoir une roue de secours. En juin, des contrôles à l’exportation décidés par Washington ont obligé Anthropic à couper pendant près de trois semaines son modèle le plus avancé accessible au public, pour tous ses utilisateurs. Selon Reuters, Pékin a envisagé en juillet de restreindre l’accès étranger aux futurs modèles de ses champions, Z.ai compris16. Un modèle ouvert déjà publié, dont Mistral détient les fichiers, protège mieux la version en service ; il ne garantit rien pour les suivantes. La carte de dépendance par fonction vous aide à repérer les usages qui ont besoin d’un plan de secours.

Trois gestes simples pour cette semaine

  • Rassembler vos meilleures consignes dans un document partagé. Demandez à chaque collaborateur d’y copier les consignes (ou prompts) qu’il réutilise chaque semaine, avec un exemple de résultat réussi. Quelques minutes par personne suffisent. Ce document vous appartient, quel que soit l’outil de demain.

  • Écrire ce qu’est une bonne réponse. Pour votre tâche la plus fréquente, une réponse à un client par exemple, écrivez en cinq lignes ce qu’une bonne réponse doit contenir, et ce qu’elle ne doit jamais contenir. Ces cinq lignes vous permettront de juger ce que produit n’importe quel outil plutôt que de le croire, et de former les nouveaux arrivants.

  • Soumettre la même demande à deux outils. Prenez une vraie demande de la semaine, sans données confidentielles, et posez-la à votre assistant habituel puis à un autre. Comparez les deux réponses avec vos cinq lignes. Vous saurez si votre assistant fait l’affaire, et vous aurez déjà repéré votre roue de secours.

En juillet, je présentais Mistral comme une carte à mettre dans votre jeu. Je le maintiens pour les usages courants : c’est une option européenne sérieuse, à condition de savoir que « Mistral » ne désigne plus forcément le modèle, et que « européen » ne décrit pas tous les exploitants de son infrastructure. Dans tous les cas, votre méthode vous protège mieux que le choix du fournisseur. Le cap IA offert permet de la construire avec un regard extérieur.

Notes

  1. Vibe (@mistralvibe), message sur X, 21 septembre 2026. Verbatim : « GLM 5.3, hosted on Mistral, is now in Vibe Code, and the default in the web app. 1M context window and generous limits included. » « Mistral met GLM 5.3 par défaut dans Vibe Code et relance le procès en renoncement », Next, 25 septembre 2026. Next y lit un passage par défaut dans la version web de Vibe Code, et rapporte des réponses de Mistral à des internautes selon lesquelles « le mode Work de la version Web va lui aussi passer à GLM 5.3 ». Vibe a pris la suite de Le Chat le 28 mai 2026, et ses modes Chat et Work sont fusionnés depuis le 22 septembre, selon le journal des versions et la documentation de Mistral. ↩

  2. Mistral, liste des sous-traitants de son Trust Center, consultée le 29 septembre 2026. Y figurent Microsoft (Suède, Norvège) et Google (Pays-Bas, Belgique) pour une partie de l’infrastructure, Mistral Compute (France), CoreWeave (Espace économique européen) pour une partie des calculs, Brave (États-Unis) pour la recherche sur le web et Black Forest Labs (États-Unis) pour la génération d’images ; Z.ai n’y figure pas. Mistral, « Where do you store my data or my Organization’s data? », centre d’aide, page datée du 12 août 2026 : données hébergées par défaut dans l’Union européenne, sauf choix explicite du point d’accès américain, avec des transferts temporaires possibles selon les fonctions utilisées, dont une partie peut être désactivée dans l’offre Entreprise. ↩ ↩2

  3. « bug: Work web/mobile: no model picker after Chat+Work merge », signalement n° 1150 sur le dépôt public mistral-vibe, GitHub, 26 septembre 2026. Un abonné Pro y indique que, depuis la fusion des modes, Work n’a plus de sélecteur de modèle et n’affiche pas le modèle utilisé, alors que le choix reste possible dans Vibe Code et sur la plateforme pour développeurs. Il s’agit d’un témoignage d’utilisateur. ↩

  4. Mistral, « In-region inference, open models, and new European infrastructure for sovereign AI », 11 août 2026. Verbatim : « Mistral’s platform will support third-party open models, starting with Z.ai’s GLM-5.2. » Les fiches de GLM-5.2 (ajoutée le 6 août) et de GLM-5.3 (ajoutée le 15 septembre) dans la documentation de Mistral présentent les deux modèles en préversion publique, « served without Mistral modifications ». ↩

  5. Z.ai, rapport semestriel déposé à la Bourse de Hong Kong, 31 août 2026, qui présente la société comme « Z.AI Co., Ltd. (formerly known as Knowledge Atlas Technology Joint Stock Company Limited) » : c’est le nouveau nom international de Zhipu AI, créée en 2019 par une équipe issue de l’université Tsinghua, selon son prospectus d’introduction en Bourse du 30 décembre 2025. La licence de GLM-5.3, publiée avec ses fichiers sur Hugging Face, reprend la base MIT (usage commercial, redistribution et déploiement autorisés) et réserve un contrôle de sécurité préalable aux groupes qui revendent l’accès au modèle et dépassent 10 milliards de dollars de chiffre d’affaires. D’où le terme de modèle « ouvert » plutôt que « open source ». ↩

  6. Mistral, grille tarifaire de son API, consultée le 28 septembre 2026 : GLM 5.3 à 1,4 dollar par million de jetons (unités de texte) en entrée et 4,4 dollars en sortie ; Mistral Medium 3.5 à 1,5 et 7,5 dollars. Z.ai, fiche de GLM-5.3 sur Hugging Face, 28 août 2026. Sur les tests de programmation retenus par Z.ai, GLM-5.3 se situe selon les cas en retrait, à égalité ou devant les modèles d’Anthropic et d’OpenAI de l’époque, et derrière d’autres modèles ouverts chinois sur certains tests. Plusieurs de ces tests font tourner les modèles dans Claude Code, l’agent de programmation d’Anthropic : ils mesurent donc le modèle avec l’outil qui l’utilise. ↩

  7. Amazon, « Amazon Bedrock is now generally available », 28 septembre 2023, avec les modèles d’Anthropic, Meta ou Cohere. Microsoft, « Introducing Mistral-Large on Azure in partnership with Mistral AI », 26 février 2024. Côté modèles chinois : DeepSeek R1 chez Microsoft en janvier 2025 et chez Amazon en mars 2025, GLM 5.2 chez Google en août 2026 et, en France, chez Scaleway dès le 26 juin 2026, six semaines avant Mistral. Ni OpenAI ni Anthropic ne vendent l’accès aux modèles d’un concurrent sur leur propre plateforme (vérification du 28 septembre 2026). ↩

  8. Mistral, « Mistral raises €3B to make sovereign, open-weight AI the technology frontier », 8 septembre 2026. La levée, menée par Samsung Electronics, valorise Mistral à plus de 21 milliards d’euros ; elle doit « significantly expand Mistral’s frontier research » et augmenter sa capacité de calcul « for training powerful models ». Verbatim : « During the first wave of generative AI, the central question was who could build the most powerful model. Organizations and governments are now asking a different one. » ↩

  9. Arthur Mensch, « Who Wins if AI Models Commoditize? », Big Technology Podcast, 14 janvier 2026. Verbatim : « inherently, this is a technology that is going to get commoditized ». Il justifie cette prévision par la circulation rapide des savoir-faire entre la dizaine de laboratoires capables de fabriquer ces modèles. ↩

  10. Microsoft, « Microsoft and Mistral expand strategic partnership to give enterprises and regulated industries frontier AI they can control », 21 juillet 2026. Microsoft y annonce « a multibillion dollar commitment » pour utiliser la capacité de calcul de Mistral en Europe. ↩

  11. Mistral, journal des versions de sa documentation : dernier modèle généraliste, Mistral Medium 3.5, le 28 avril 2026 ; depuis, OCR 4, Leanstral 1.5 et OCR 4.1, des modèles spécialisés. Arthur Mensch, message sur X, 16 juin 2026. Verbatim : « we have a nice model coming this summer […] This will be the start of a new family of models […] We’re opening up an early access program in July for key partners ». ↩

  12. Anthropic, historique des versions de Claude Fable : Fable 5.1 le 1er septembre 2026. OpenAI, journal des versions de Codex : GPT-6 Sol et GPT-6 Luna le 22 septembre 2026. ↩

  13. Mistral, présentation de Vibe dans sa documentation, consultée le 29 septembre 2026. Verbatim : « Across every mode, you interact with Vibe the same way: same Mistral models, same patterns, same control. » ↩

  14. United States Code, titre 18, § 2713, issu du CLOUD Act du 23 mars 2018. Un fournisseur de services de communication ou de stockage doit communiquer les données en sa possession, sa garde ou son contrôle « regardless of whether such communication, record, or other information is located within or outside of the United States ». ↩

  15. Administration chinoise du cyberespace, mesures provisoires sur la gestion des services d’intelligence artificielle générative, en vigueur depuis le 15 août 2023. Leur article 4 fixe les règles de contenu des services d’IA générative proposés au public en Chine. ↩

  16. Anthropic, « Redeploying Claude Fable 5 », 30 juin 2026. Fable 5 a été suspendu pour tous les utilisateurs du 12 juin au 1er juillet, faute de pouvoir vérifier leur nationalité en temps réel ; sa version aux garde-fous allégés, Mythos 5, était déjà réservée à quelques partenaires. Fanny Potkin, « Beijing is looking at curbing overseas access to China’s top AI models, sources say », Reuters, 7 juillet 2026 : discussions avec Alibaba, ByteDance et Z.ai, sans décision arrêtée. ↩

Et pour votre entreprise, concrètement ?

Votre cap IA part de votre situation réelle : un échange de 30 minutes, puis un état des lieux écrit. Offert, sans engagement.

Mon cap IA offert · 30 min