Las pruebas iniciales del modelo DeepSeek v4 Flash indican mejoras notables en sus habilidades de diseño de interfaz de usuario y experiencia de usuario. A pesar de estas mejoras, se señala que el modelo es hambriento de tokens.
Las pruebas iniciales de DeepSeek v4 Flash muestran mejoras significativas en las capacidades de diseño de UI/UX
PIVOT comparte escaneos de prefijo entre grupos de consultas para acelerar la atención dispersa a nivel de token
PIVOT (Proxy Indexing Via One full-prefix Traversal) es una solución sin entrenamiento y de inserción directa para el indexador DeepSeek Sparse Attention (DSA) que reduce la redundancia computacional compartiendo un solo escaneo de prefijo entre un grupo de consultas cercanas. En lugar de puntuar cada token precedente para cada consulta individualmente, PIVOT agrega el grupo en una única consulta proxy para obtener un conjunto candidato, del cual se seleccionan los top-k tokens para cada consulta.
Cuantización de código agrupado para compresión de imágenes basada en Gaussiana 2D
Los investigadores presentan Cluster-Guided Vector Quantization (CGVQ), un método diseñado para mejorar el rendimiento de tasa-distorsión en la compresión de imágenes basada en primitivas gaussianas. El enfoque particiona los parámetros de Gaussiana en grupos homogéneos antes de la cuantización, abordando la ineficiencia causada por almacenar grandes cantidades de parámetros de punto flotante por primitiva.
Diffusers añade soporte nativo para inferencia Nunchaku Lite de 4 bits
Hugging Face Diffusers ahora admite la carga de checkpoints de Nunchaku Lite de forma nativa mediante `from_pretrained()`, eliminando la necesidad de un motor de inferencia separado o compilación local de CUDA. Esta integración utiliza el método SVDQuant para ejecutar capas transformadoras con pesos y activaciones de 4 bits (W4A4), reduciendo significativamente el uso de memoria mientras mejora la velocidad de inferencia.
Usuario solicita cuantización ConvRot INT8 para FireRed Image Edit v1.1
Un usuario en los foros de Hugging Face está consultando sobre el posible desarrollo de una versión ConvRot INT8 o FP8 para el modelo FireRed Image Edit v1.1.
ZimengXiong porta Hunyuan3D a MLX para Apple Silicon e iPhone
El desarrollador ZimengXiong ha completado un puerto Swift-MLX y Python MLX de los modelos Hunyuan3D-Paint y Hunyuan3D-Shape, habilitando la generación local de imágenes a 3D en dispositivos Apple Silicon. El trabajo se distribuye como la aplicación de escritorio Modelr de código abierto para macOS e iOS, junto con el código fuente para integrar la tecnología en aplicaciones Swift.