DeepSeek ha publicado el checkpoint del modelo DeepSeek-V4-Flash-Vision-Exp en Hugging Face. El repositorio ya está disponible para acceso público.
DeepSeek lanza DeepSeek-V4-Flash-Vision-Exp en Hugging Face
Thinking Machines lanza Inkling, Tencent actualiza Hy3 con licencia Apache 2.0
La última recopilación de artefactos de modelos abiertos destaca lanzamientos significativos de Thinking Machines y Tencent, junto con actualizaciones de Poolside y DeepSeek.
Thinking Machines Lab lanza el modelo base de Inkling con pesos abiertos
Thinking Machines Lab ha lanzado Inkling, su primera familia completa de modelos base con pesos abiertos. Posicionado como un modelo base multimodal personalizable en lugar de una bandera máxima en benchmarks, Inkling admite entradas de texto, imagen y audio con multimodalidad nativa.
El poder de la inteligencia está mejor en manos del pueblo que en las salas de juntas de los magnates
El proyecto PearlOS ha lanzado una plataforma de inteligencia enjambre de código abierto que utiliza modelos locales para manejar tareas multimodales. Selecciona y cambia automáticamente entre los mejores modelos según benchmarks, asegurando que los usuarios siempre accedan a los modelos más recientes y capaces sin depender de sistemas de código cerrado ni suscripciones.
El equipo de Qwen de Alibaba lanza Qwen3.8-Flash-Next, una vista previa de 125B que antecede a Qwen4
El equipo de Qwen de Alibaba ha lanzado Qwen3.8-Flash-Next, un modelo Mixture-of-Experts multimodal de pesos abiertos diseñado para anticipar la arquitectura de la próxima serie Qwen4. El punto de control combina una columna vertebral de 125B con una tabla de incrustaciones N-gram de 51B y un módulo de predicción multi-token de 4B, activando solo 6B parámetros por token.
Zhipu AI lanza GLM-5.3-Flash, un modelo de peso abierto multimodal
Zhipu AI ha lanzado GLM-5.3-Flash, el primer modelo nativamente multimodal de la serie GLM-5 y el primer lanzamiento de peso abierto de la arquitectura glm5_next. El modelo de 320B parámetros se entrena en un corpus multimodal de 30T tokens y presenta un mecanismo de atención híbrido disperso y lineal para reducir los costos de servicio de contexto largo.