A equipe da Qwen lançou o modelo Qwen3.8-Flash-Next, que agora está disponível no ModelScope.
Este lançamento introduz uma nova variante na série Qwen3.8-Flash.
A equipe da Qwen lançou o modelo Qwen3.8-Flash-Next, que agora está disponível no ModelScope.
Este lançamento introduz uma nova variante na série Qwen3.8-Flash.
A Ant Group abriu o código-fonte do Ling-3.0-flash-Fin, o primeiro modelo da família Ant Ling com capacidades financeiras aprimoradas, desenvolvido em parceria com instituições financeiras de ponta e especialistas do setor.
A Alibaba lançou uma versão aprimorada de seu modelo de linguagem grande, o Qwen3.8-Max-0902. O novo modelo possui 2,4 trilhões de parâmetros e suporta uma janela de contexto de 1 milhão de tokens.
As notícias de IA desta semana destacam lançamentos significativos de modelos de pesos abertos da Z.ai, Tencent e Alibaba, além de avanços em infraestrutura de inferência e avaliação de agentes.
A equipe Qwen da Alibaba lançou o Qwen3.8-Flash-Next, um modelo Mixture-of-Experts multimodal de pesos abertos projetado para antecipar a arquitetura da próxima série Qwen4. O checkpoint combina uma base de 125B com uma tabela de embeddings N-gram de 51B e um módulo de previsão multi-token de 4B, ativando apenas 6B de parâmetros por token.
Os autores apresentam Quantization-Aware Healing (QAH), um pipeline que destila estudantes de 4 bits diretamente de modelos não comprimidos para recuperar o desempenho perdido durante a compressão estrutural e quantização. Aplicado ao GPT-OSS 120B, este método produz Hypernova-60B, que iguala ou supera a fonte bfloat16 em 7 dos 9 benchmarks enquanto usa aproximadamente 4 vezes menos memória de peso.
Usamos cookies para medir o tráfego e melhorar o site. Você pode aceitar ou recusar os cookies de análise. Política de privacidade