A Qwen liberou os pesos abertos para seu modelo Qwen 3.8 27B. O checkpoint está disponível no Hugging Face.
Qwen libera pesos abertos para Qwen 3.8 27B
PrismML lança Bonsai 27B, comprimindo Qwen3.6-27B para pesos de 1-bit e ternários
A PrismML lançou o Bonsai 27B, uma quantização de baixa precisão do modelo Qwen3.6-27B que permite executar grandes modelos multimodais em laptops e celulares sem necessidade de retreinamento.
Qwen3.5 122B A10B no formato UD-Q2_K_XL cabe em 64 GB de RAM e melhora o conhecimento interno
Um usuário demonstra que Qwen3.5 122B A10B quantizado com UD-Q2_K_XL pode caber em 64 GB de RAM do sistema, substituindo a melhor opção anterior para essa restrição.
Qwen3.6 ternário de 27B roda a 60 tok/s em duas RTX 3090
Um usuário relata ter executado com sucesso o modelo Qwen3.6 de 27B quantizado em ternário em duas GPUs NVIDIA RTX 3090. A configuração alcança uma taxa de transferência de 60 tokens por segundo com capacidades estáveis de chamada de ferramentas.
PrismML comprime Qwen3.6-27B para <4 GB no iPhone
A PrismML desenvolveu uma versão comprimida do modelo de código aberto Qwen 3.6 da Alibaba, permitindo que o grande modelo de linguagem com 27 bilhões de parâmetros seja executado em um iPhone 17 Pro. A startup reduziu o tamanho do modelo de aproximadamente 54 gigabytes para menos de 4 gigabytes usando uma técnica matemática derivada de pesquisas do Caltech.
NVIDIA lança o modelo Qwen3.6-27B-NVFP4
A NVIDIA lançou o modelo Qwen3.6-27B-NVFP4 no Hugging Face.