El equipo de Qwen ha lanzado el modelo Qwen3.8-Flash-Next, que ya está disponible en ModelScope.
Este lanzamiento introduce una nueva variante en la serie Qwen3.8-Flash.
El equipo de Qwen ha lanzado el modelo Qwen3.8-Flash-Next, que ya está disponible en ModelScope.
Este lanzamiento introduce una nueva variante en la serie Qwen3.8-Flash.
Ant Group ha abierto el código fuente de Ling-3.0-flash-Fin, el primer modelo de la familia Ant Ling con capacidades financieras mejoradas, desarrollado junto con instituciones financieras líderes y expertos del sector.
Alibaba ha lanzado una versión mejorada de su modelo de lenguaje grande, Qwen3.8-Max-0902. El nuevo modelo cuenta con 2,4 billones de parámetros y admite una ventana de contexto de 1 millón de tokens.
Las noticias de IA de esta semana destacan importantes lanzamientos de modelos con pesos abiertos de Z.ai, Tencent y Alibaba, junto con avances en infraestructura de inferencia y evaluación de agentes.
El equipo de Qwen de Alibaba ha lanzado Qwen3.8-Flash-Next, un modelo Mixture-of-Experts multimodal de pesos abiertos diseñado para anticipar la arquitectura de la próxima serie Qwen4. El punto de control combina una columna vertebral de 125B con una tabla de incrustaciones N-gram de 51B y un módulo de predicción multi-token de 4B, activando solo 6B parámetros por token.
Los autores presentan Quantization-Aware Healing (QAH), una canalización que destila estudiantes de 4 bits directamente desde modelos sin comprimir para recuperar el rendimiento perdido durante la compresión estructural y cuantización. Aplicado a GPT-OSS 120B, este método produce Hypernova-60B, que iguala o supera al bfloat16 fuente en 7 de 9 benchmarks mientras usa aproximadamente 4 veces menos memoria de peso.
Usamos cookies para medir el tráfico y mejorar el sitio. Puedes aceptar o rechazar las cookies de analítica. Política de privacidad