El modelo GLM-5.2 ya es accesible en HuggingChat. Los usuarios pueden acceder a él a través del enlace de HuggingFace proporcionado, lo que permite la interacción directa con el modelo a través de la plataforma.
GLM-5.2 ya disponible en HuggingChat
API de GLM 5.2 en vivo, pesos en Hugging Face, soporte para Ollama
La API de GLM 5.2 ya está disponible, con los pesos del modelo accesibles en Hugging Face bajo la licencia MIT y compatibles con Ollama. El modelo ofrece dos modos de pensamiento —Alto y Máximo— con una longitud de contexto de 1M, con un precio de $1.4 por cada 1M tokens de entrada y $4.4 por cada 1M tokens de salida, igual que GLM-5.1.
Mistral lanza puntos de conexión regionales, soporte para modelos abiertos y coalición europea de computación
Mistral avanza en la soberanía de la IA introduciendo los Puntos de Conexión Regionales de Mistral para inferencia dentro de la región, ampliando su plataforma para admitir modelos abiertos de terceros y formando una coalición para asegurar capacidad de computación de IA europea a largo plazo.
Macaron-V1 presenta una familia de modelos-agente abierta con Mixture-of-LoRA para aprendizaje continuo
Macaron-V1 es una familia de modelos-agente abierta diseñada para la inteligencia experiencial, que permite aprender de entornos reales y continuar aprendiendo después del despliegue. El sistema se centra en dos objetivos: adaptación mediante la mejora recursiva de los pares modelo-arnés y colaboración a través de una arquitectura Mixture-of-LoRA (MoL) que selecciona adaptadores LoRA especialistas por turno de usuario.
Macaron-V1 presenta una familia de modelos-agente abierta con Mixture-of-LoRA para aprendizaje continuo
Macaron-V1 es una familia de modelos-agente abierta diseñada para la inteligencia experiencial, permitiendo que los sistemas aprendan de experiencias del mundo real y continúen mejorando después del despliegue. La arquitectura se centra en dos objetivos: adaptación mediante la mejora recursiva de pares modelo-arnés, y colaboración a través de un sistema Mixture-of-LoRA (MoL) que selecciona adaptadores especialistas por turno de usuario.
Alibaba lanza Qwen3.8-Max, un modelo MoE de 2.4T parámetros
El equipo Qwen de Alibaba ha puesto Qwen3.8-Max ampliamente disponible a través de API, con pesos abiertos tanto para Qwen3.8-Max como para el checkpoint más pequeño Qwen3.8-27B programado para lanzarse la próxima semana. El modelo insignia es una arquitectura de mezcla de expertos de 2.4 billones de parámetros que acepta entradas de texto, imagen y video.