A versão v0.29.0rc2 inclui uma correção de bug para o cache do worker SHM para lidar corretamente com itens cobertos por prefixo.
- Resolve um problema onde itens cobertos por prefixo não eram tratados corretamente no cache do worker SHM.
A versão v0.29.0rc2 inclui uma correção de bug para o cache do worker SHM para lidar corretamente com itens cobertos por prefixo.
A DeepSeek publicou o checkpoint do modelo DeepSeek-V4-Flash-Vision-Exp no Hugging Face. O repositório já está disponível para acesso público.
A equipe Qwen da Alibaba lançou o Qwen3.8-Flash-Next, um modelo Mixture-of-Experts multimodal de pesos abertos projetado para antecipar a arquitetura da próxima série Qwen4. O checkpoint combina uma base de 125B com uma tabela de embeddings N-gram de 51B e um módulo de previsão multi-token de 4B, ativando apenas 6B de parâmetros por token.
A Zhipu AI lançou o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5 e o primeiro lançamento de pesos abertos da arquitetura glm5_next. O modelo com 320B parâmetros é treinado em um corpus multimodal de 30T tokens e apresenta um mecanismo de atenção híbrido esparso e linear para reduzir os custos de serviço de contexto longo.
A Zai apresentou o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5. Ele possui uma arquitetura híbrida que combina atenção esparsa e linear para reduzir os custos de serviço de contextos longos enquanto mantém capacidades precisas.
A ZhiPu apresenta o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5, que possui uma arquitetura híbrida combinando atenção esparsa e linear para reduzir os custos de serviço de contexto longo enquanto preserva a precisão.
Usamos cookies para medir o tráfego e melhorar o site. Você pode aceitar ou recusar os cookies de análise. Política de privacidade