O usuário Achilles1089 enviou ao Hugging Face um modelo híbrido "fable e opus 4.8" sem censura, afirmando que os números demonstram sua eficácia.
O modelo é.
O usuário Achilles1089 enviou ao Hugging Face um modelo híbrido "fable e opus 4.8" sem censura, afirmando que os números demonstram sua eficácia.
O modelo é.
A equipe Qwen da Alibaba anunciou o Qwen 3.8 Max, um novo modelo principal de 2,4T parâmetros focado em codificação, trabalho agêntico de longo prazo e raciocínio multimodal. A empresa confirmou que as versões com pesos abertos do Qwen 3.8 Max e do menor Qwen 3.8-27B serão lançadas na próxima semana.
A Alibaba anunciou o lançamento de peso aberto do Qwen3.8, um modelo com 2,4 trilhões de parâmetros, enquanto também tornava open-source sua stack de software para o chip Zhenwu AI, visando reduzir a dependência do ecossistema CUDA da Nvidia.
A Alibaba lançou o Qwen3.6-27B, um novo modelo denso de código aberto com 27 bilhões de parâmetros que supera seu predecessor muito maior, o Qwen3.5-397B-A17B, em quase todos os benchmarks de codificação testados.
A equipe Qwen da Alibaba lançou o Qwen3-Coder-480B-A35B-Instruct em julho de 2025, um modelo Mixture-of-Experts com 480 bilhões de parâmetros que ativa apenas 35 bilhões de parâmetros por inferência. Ele alcança desempenho em programação comparável ao Claude Sonnet 4 e GPT-4, sendo totalmente de código aberto sob a licença Apache 2.0.
A equipe da Qwen apresentou a série Qwen2.5-Coder, um novo conjunto de modelos de linguagem específicos para código derivados da arquitetura Qwen2.5. A série inclui seis tamanhos de modelo variando de 0.5B a 32B parâmetros e é treinada em mais de 5.5 trilhões de tokens de código-fonte limpo e dados sintéticos.
Usamos cookies para medir o tráfego e melhorar o site. Você pode aceitar ou recusar os cookies de análise. Política de privacidade