Les tests initiaux du modèle DeepSeek v4 Flash indiquent des améliorations notables dans ses compétences de conception d'interface utilisateur et d'expérience utilisateur. Malgré ces améliorations, le modèle est noté comme étant gourmand en tokens.
Les tests initiaux de DeepSeek v4 Flash montrent des améliorations significatives dans les capacités de design UI/UX
PIVOT partage les scans de préfixe entre groupes de requêtes pour accélérer l'attention sparse au niveau des tokens
PIVOT (Proxy Indexing Via One full-prefix Traversal) est un remplacement plug-in sans entraînement pour l'indexeur DeepSeek Sparse Attention (DSA) qui réduit la redondance computationnelle en partageant un seul scan de préfixe entre un groupe de requêtes proches. Au lieu de scorer chaque token précédent pour chaque requête individuellement, PIVOT agrège le groupe en une seule requête proxy pour obtenir un ensemble de candidats, à partir duquel les top-k tokens sont sélectionnés pour chaque requête.
Quantification de codebook clusterisé pour la compression d'images basée sur des Gaussiennes 2D
Les chercheurs présentent Cluster-Guided Vector Quantization (CGVQ), une méthode conçue pour améliorer les performances taux-distorsion de la compression d'images basée sur des primitives gaussiennes. L'approche partitionne les paramètres de Gaussienne en groupes homogènes avant la quantification, traitant l'inefficacité causée par le stockage de grands nombres de paramètres à virgule flottante par primitive.
Diffusers ajoute le support natif de l'inférence Nunchaku Lite 4-bit
Hugging Face Diffusers prend désormais en charge le chargement natif des points de contrôle Nunchaku Lite via `from_pretrained()`, éliminant ainsi le besoin d'un moteur d'inférence séparé ou d'une compilation CUDA locale. Cette intégration utilise la méthode SVDQuant pour exécuter les couches transformateur avec des poids et activations en 4 bits (W4A4), réduisant considérablement l'utilisation de la mémoire tout en améliorant la vitesse d'inférence.
Un utilisateur demande la quantification ConvRot INT8 pour FireRed Image Edit v1.1
Un utilisateur des forums Hugging Face s'enquiert du développement potentiel d'une version ConvRot INT8 ou FP8 pour le modèle FireRed Image Edit v1.1.
ZimengXiong porte Hunyuan3D sur MLX pour Apple Silicon et iPhone
Le développeur ZimengXiong a terminé le portage des modèles Hunyuan3D-Paint et Hunyuan3D-Shape vers Swift-MLX et Python MLX, permettant la génération locale d'images en 3D sur les appareils Apple Silicon. Le travail est distribué sous forme d'application de bureau open-source Modelr pour macOS et iOS, ainsi que du code source pour intégrer cette technologie dans des applications Swift.