Mistral a lancé une préversion publique de Mistral Large 4 (ML4), un modèle multimodal natif à 1 billion de paramètres avec 49 milliards de paramètres actifs. Les poids seront publiés à la fin du mois, tandis que l'API de préversion est actuellement disponible sur Mistral Studio.
- Entraîné à partir de zéro sur 3 800 GPU NVIDIA Grace Blackwell dans les datacenters européens de Mistral.
- Se classe parmi les cinq meilleurs modèles mondiaux sur l'indice Cyber d'Artificial Analysis et domine les modèles à poids ouverts développés en dehors de la Chine.
- Atteint des performances de pointe sur SciCode-Verified parmi les modèles à poids ouverts pour les workflows scientifiques.
- Surpasse GPT-6-Astra sur les benchmarks d'ancrage visuel tels que Dense 200.
- Résiste à 93,3 % des attaques sur le benchmark de sécurité AI B3 de Lakera.
Le modèle est conçu pour fournir une IA souveraine et auditable pour des secteurs critiques tels que la cybersécurité et la finance, permettant aux organisations d'exécuter des travaux de sécurité avancés selon leurs propres politiques sans refus au niveau du fournisseur.