L'utilisateur Achilles1089 a téléchargé sur Hugging Face un modèle hybride "fable and opus 4.8" non censuré, affirmant que les chiffres en démontrent l'efficacité.
Le modèle est.
L'utilisateur Achilles1089 a téléchargé sur Hugging Face un modèle hybride "fable and opus 4.8" non censuré, affirmant que les chiffres en démontrent l'efficacité.
Le modèle est.
L'équipe Qwen d'Alibaba a annoncé Qwen 3.8 Max, un nouveau modèle phare de 2,4T de paramètres axé sur le codage, les travaux agents à long terme et le raisonnement multimodal. L'entreprise a confirmé que des versions à poids ouverts de Qwen 3.8 Max et du plus petit Qwen 3.8-27B seront publiées la semaine prochaine.
Alibaba a annoncé la sortie en poids ouverts de Qwen3.8, un modèle de 2,4 billions de paramètres, tout en open-sourçant sa pile logicielle Zhenwu AI pour réduire la dépendance à l'écosystème CUDA de Nvidia.
Alibaba a publié Qwen3.6-27B, un nouveau modèle dense open-source avec 27 milliards de paramètres qui surpasse son prédécesseur beaucoup plus grand, Qwen3.5-397B-A17B, sur presque tous les benchmarks de codage testés.
L'équipe Qwen d'Alibaba a publié en juillet 2025 Qwen3-Coder-480B-A35B-Instruct, un modèle Mixture-of-Experts de 480 milliards de paramètres qui n'active que 35 milliards de paramètres par inférence. Il atteint des performances de codage comparables à Claude Sonnet 4 et GPT-4 tout en étant entièrement open-source sous licence Apache 2.0.
L'équipe de Qwen a présenté la série Qwen2.5-Coder, un nouvel ensemble de modèles de langage spécifiques au code dérivés de l'architecture Qwen2.5. La série comprend six tailles de modèle allant de 0,5B à 32B de paramètres et est entraînée sur plus de 5,5 billions de tokens de code source nettoyé et de données synthétiques.
Nous utilisons des cookies pour mesurer l'audience et améliorer le site. Vous pouvez accepter ou refuser les cookies analytiques. Politique de confidentialité