Qwen ha liberado los pesos abiertos para su modelo Qwen 3.8 27B. El checkpoint está disponible en Hugging Face.
Qwen libera los pesos abiertos para Qwen 3.8 27B
PrismML lanza Bonsai 27B, comprimiendo Qwen3.6-27B a pesos de 1 bit y ternarios
PrismML ha lanzado Bonsai 27B, una cuantización de bajo ancho de banda del modelo Qwen3.6-27B que permite ejecutar grandes modelos multimodales en portátiles y teléfonos sin necesidad de reentrenamiento.
Qwen3.5 122B A10B en formato UD-Q2_K_XL cabe en 64 GB de RAM y mejora el conocimiento interno
Un usuario demuestra que Qwen3.5 122B A10B cuantizado con UD-Q2_K_XL puede caber en 64 GB de RAM del sistema, reemplazando la mejor opción anterior para esa restricción.
Qwen3.6 ternario de 27B funciona a 60 tok/s en dos RTX 3090
Un usuario informa haber ejecutado con éxito el modelo Qwen3.6 de 27B cuantizado en ternario en dos GPUs NVIDIA RTX 3090. La configuración logra un rendimiento de 60 tokens por segundo con capacidades estables de llamada de herramientas.
PrismML comprime Qwen3.6-27B a <4 GB para iPhone
PrismML ha desarrollado una versión comprimida del modelo de código abierto Qwen 3.6 de Alibaba, permitiendo que el gran modelo de lenguaje con 27 mil millones de parámetros se ejecute en un iPhone 17 Pro. La startup redujo el tamaño del modelo de aproximadamente 54 gigabytes a menos de 4 gigabytes utilizando una técnica matemática derivada de investigaciones del Caltech.
NVIDIA lanza el modelo Qwen3.6-27B-NVFP4
NVIDIA ha lanzado el modelo Qwen3.6-27B-NVFP4 en Hugging Face.