DeepSeek a retiré doucement le modèle DeepSeek V4 Pro. Cette action marque la fin de la disponibilité de cette version spécifique de son système d'IA.
DeepSeek a retiré doucement le modèle DeepSeek V4 Pro
DeepSeek publie V4.1 Flash, un modèle MoE de 552B à moindre coût et plus rapide
DeepSeek a officiellement publié le modèle DeepSeek V4.1 Flash, la version la plus légère de sa nouvelle série d'architectures dotée d'une compréhension visuelle multimodale native. Construit sur une conception Causal-Encoder-Decoder, il s'agit d'un modèle Mixture of Experts (MoE) de 552 milliards de paramètres qui n'active que 8 milliards de paramètres du côté entrée et 16 milliards du côté sortie.
DeepSeek lance le modèle V4.1-Flash avec support multimodal natif
DeepSeek a officiellement lancé le modèle DeepSeek-V4.1-Flash, qui est le plus petit membre de sa nouvelle famille d'architectures et présente une compréhension visuelle multimodale native. Cette nouvelle architecture est conçue pour offrir un plafond de capacité plus élevé, des vitesses d'inférence plus rapides, un débit supérieur et un meilleur potentiel de mise à l'échelle pour les modèles plus grands.
DeepSeek ouvre le bêta interne pour DeepSeek V4.1 Flash avec support multimodal natif
DeepSeek a ouvert les tests bêta internes pour une version intermédiaire de son modèle DeepSeek V4.1 Flash, désormais disponible via API.
DeepSeek Flash Vision, sécurité de Claude Mythos, expansion de Grok Bot
Cette newsletter TLDR AI couvre plusieurs développements dans le secteur de l'IA, notamment la sortie de Flash Vision par DeepSeek et les nouvelles mesures de sécurité d'Anthropic pour Claude Mythos 5. Elle détaille également l'expansion de Grok Bot à davantage d'abonnements et rapporte une valorisation potentielle de Hugging Face à 13 milliards de dollars.
La version GA de DeepSeek-V4-Pro améliore les capacités des agents et ajoute le support de l'API Responses
La disponibilité générale de DeepSeek-V4-Pro a été déployée sur les plateformes APP, Web et API. Cette mise à jour augmente considérablement les performances des agents dans les environnements de production tout en introduisant un support natif pour le format de l'API Responses d'OpenAI.