DeepSeek a mis à jour son modèle DeepSeek-V4-Flash et a annoncé que la version officielle de DeepSeek-V4-Pro suivrait de peu.
La mise à jour est confirmée via la page des mises à jour de la documentation API de l'entreprise.
DeepSeek a mis à jour son modèle DeepSeek-V4-Flash et a annoncé que la version officielle de DeepSeek-V4-Pro suivrait de peu.
La mise à jour est confirmée via la page des mises à jour de la documentation API de l'entreprise.
Une discussion sur Reddit suggère que la version flash de sortie de DeepSeek v4 a probablement été activée sur l'API, après sa phase initiale d'aperçu. Le timing coïncide avec les poids ouverts prévus pour mi-juillet.
DeepSeek a publié DeepSeek-V3, un puissant modèle de langage à experts multiples (MoE) comportant 671B paramètres au total dont 37B activés par token. Le modèle utilise une attention latente multi-têtes et une stratégie d'équilibrage de charge sans perte auxiliaire, entraîné sur 14,8 billions de tokens en précision mixte FP8.
La version officielle de DeepSeek-V4-Flash est désormais disponible sur l'API DeepSeek.
LG AI Research a publié K-EXAONE 2.0, un modèle de 750 milliards de paramètres développé dans le cadre de la phase 2 du projet de modèle fondamental d'IA souveraine de Corée.
Together AI a annoncé un partenariat stratégique avec Moonshot AI pour servir de plateforme de lancement des modèles open-weight de Moonshot, en commençant par Kimi K3. Cette collaboration offre aux développeurs un accès immédiat aux dernières versions grâce à l'infrastructure et aux outils hébergés aux États-Unis par Together AI.
Nous utilisons des cookies pour mesurer l'audience et améliorer le site. Vous pouvez accepter ou refuser les cookies analytiques. Politique de confidentialité