Logdyco

Mistral, ou comment le champion européen de l'IA devient un installateur de modèles chinois

À Propos de la souveraineté chez Mistral:

Large 3, le modèle phare sorti en décembre 2025, était déjà construit sur une architecture chinoise. La configuration est celle de DeepSeek V3, ligne par ligne : même hidden dim de 7168, mêmes 61 couches, mêmes 3 couches denses avant les couches MoE (mixture of experts), même multi-head latent attention jusqu'aux rangs de compression des matrices. La seule modification structurelle porte sur la granularité des experts, un choix qui améliore le débit d'inférence, pas la capacité du modèle.

Mistral prend un tournant commercial, OK, mais est-ce que sa R&D a complètement été mise à l'arrêt pour autant ?

On lit cette mutation jusque dans les offres d'emploi. La page carrières qui ressemblait autrefois à celle d'un laboratoire ressemble aujourd'hui à celle d'une ESN

Extraits cités issus de ce lien visité le , crédits: Pierre-Louis Biojout (Journal du Net)