Qwen a publié les poids ouverts pour son modèle Qwen 3.8 27B. Le checkpoint est disponible sur Hugging Face.
Qwen publie les poids ouverts pour Qwen 3.8 27B
PrismML publie Bonsai 27B, compressant Qwen3.6-27B en poids 1-bit et ternaires
PrismML a publié Bonsai 27B, une quantification basse précision du modèle Qwen3.6-27B qui permet d'exécuter de grands modèles multimodaux sur des ordinateurs portables et des téléphones sans réentraînement.
Qwen3.5 122B A10B quantisé avec UD-Q2_K_XL tient dans 64 Go de RAM et améliore les connaissances internes
Un utilisateur démontre que Qwen3.5 122B A10B quantifié avec UD-Q2_K_XL peut tenir dans 64 Go de RAM système, remplaçant ainsi la meilleure option précédente pour cette contrainte.
Le modèle ternary Qwen3.6 27B atteint 60 tok/s sur deux RTX 3090
Un utilisateur rapporte avoir réussi à faire fonctionner le modèle Qwen3.6 27B quantifié en ternaire sur deux GPU NVIDIA RTX 3090. Cette configuration atteint un débit de 60 tokens par seconde avec des capacités d'appel d'outils stables.
PrismML compresse Qwen3.6-27B en <4Go pour iPhone
PrismML a développé une version compressée du modèle open-source Qwen3.6 d'Alibaba, permettant au grand modèle de langage de 27 milliards de paramètres de fonctionner sur un iPhone 17 Pro. La startup a réduit la taille du modèle d'environ 54 gigaoctets à moins de 4 gigaoctets en utilisant une technique mathématique dérivée de recherches du Caltech.
NVIDIA lance le modèle Qwen3.6-27B-NVFP4
NVIDIA a publié le modèle Qwen3.6-27B-NVFP4 sur Hugging Face.