Os testes iniciais do modelo DeepSeek v4 Flash indicam melhorias notáveis em suas habilidades de design de interface do usuário e experiência do usuário. Apesar dessas melhorias, observa-se que o modelo é faminto por tokens.
Testes iniciais do DeepSeek v4 Flash mostram melhorias significativas nas capacidades de design de UI/UX
PIVOT compartilha varreduras de prefixo entre grupos de consulta para acelerar a atenção esparsa em nível de token
O PIVOT (Proxy Indexing Via One full-prefix Traversal) é uma substituição plug-and-play sem treinamento para o indexador DeepSeek Sparse Attention (DSA) que reduz a redundância computacional ao compartilhar uma única varredura de prefixo entre um grupo de consultas próximas. Em vez de pontuar cada token precedente para cada consulta individualmente, o PIVOT agrega o grupo em uma única consulta proxy para obter um conjunto de candidatos, do qual os top-k tokens são selecionados para cada consulta.
Quantização de Codebook Agrupado para Compressão de Imagens Baseada em Gaussiana 2D
Pesquisadores apresentam o Cluster-Guided Vector Quantization (CGVQ), um método projetado para melhorar o desempenho de taxa-distorção na compressão de imagens baseada em primitivas gaussianas. A abordagem particiona os parâmetros de Gaussiana em grupos homogêneos antes da quantização, abordando a ineficiência causada pelo armazenamento de grandes números de parámetros de ponto flutuante por primitiva.
Diffusers adiciona suporte nativo à inferência Nunchaku Lite de 4 bits
O Hugging Face Diffusers agora suporta o carregamento nativo de checkpoints do Nunchaku Lite por meio de `from_pretrained()`, eliminando a necessidade de um mecanismo de inferência separado ou compilação CUDA local. Essa integração utiliza o método SVDQuant para executar camadas de transformador com pesos e ativações de 4 bits (W4A4), reduzindo significativamente o uso de memória enquanto melhora a velocidade de inferência.
Usuário solicita quantização ConvRot INT8 para FireRed Image Edit v1.1
Um usuário nos fóruns do Hugging Face está perguntando sobre o possível desenvolvimento de uma versão ConvRot INT8 ou FP8 para o modelo FireRed Image Edit v1.1.
ZimengXiong porta Hunyuan3D para MLX em Apple Silicon e iPhone
O desenvolvedor ZimengXiong concluiu uma versão Swift-MLX e Python MLX dos modelos Hunyuan3D-Paint e Hunyuan3D-Shape, permitindo a geração local de imagem para 3D em dispositivos Apple Silicon. O trabalho é distribuído como o aplicativo de desktop Modelr de código aberto para macOS e iOS, junto com o código-fonte para integrar a tecnologia em aplicativos Swift.