A DeepSeek publicou o checkpoint do modelo DeepSeek-V4-Flash-Vision-Exp no Hugging Face. O repositório já está disponível para acesso público.
DeepSeek lança DeepSeek-V4-Flash-Vision-Exp no Hugging Face
Thinking Machines lança Inkling, Tencent atualiza Hy3 com licença Apache 2.0
A última compilação de artefatos de modelos abertos destaca lançamentos significativos da Thinking Machines e Tencent, junto com atualizações da Poolside e DeepSeek.
Thinking Machines Lab lança o modelo base Inkling de pesos abertos
O Thinking Machines Lab lançou o Inkling, sua primeira família completa de modelos base com pesos abertos. Posicionado como um modelo base multimodal personalizável em vez de um flagship focado em benchmarks, o Inkling suporta entradas de texto, imagem e áudio com multimodalidade nativa.
Equipe Qwen da Alibaba lança Qwen3.8-Flash-Next, uma prévia de 125B do MoE que antecipa o Qwen4
A equipe Qwen da Alibaba lançou o Qwen3.8-Flash-Next, um modelo Mixture-of-Experts multimodal de pesos abertos projetado para antecipar a arquitetura da próxima série Qwen4. O checkpoint combina uma base de 125B com uma tabela de embeddings N-gram de 51B e um módulo de previsão multi-token de 4B, ativando apenas 6B de parâmetros por token.
Zhipu AI lança GLM-5.3-Flash, um modelo de pesos abertos multimodal
A Zhipu AI lançou o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5 e o primeiro lançamento de pesos abertos da arquitetura glm5_next. O modelo com 320B parâmetros é treinado em um corpus multimodal de 30T tokens e apresenta um mecanismo de atenção híbrido esparso e linear para reduzir os custos de serviço de contexto longo.
ZhiPu lança GLM-5.3-Flash, um modelo multimodal com 320B de parâmetros
A ZhiPu apresenta o GLM-5.3-Flash, o primeiro modelo nativamente multimodal da série GLM-5, que possui uma arquitetura híbrida combinando atenção esparsa e linear para reduzir os custos de serviço de contexto longo enquanto preserva a precisão.