SupraLabs ha lanzado un conjunto de datos curado de títulos de chat con 115K muestras, superando el récord anterior de 10K muestras. El conjunto filtrado está disponible como `SupraLabs/chat-titles-filtered-115K`, mientras que también se proporciona una versión sin filtrar con 150K muestras, junto con un conjunto de datos heredado de 12K.
SupraLabs lanza el mayor conjunto de datos de títulos de chat
Adaption Labs lanza 'Invent a Dataset' para generar datos de entrenamiento a partir de descripciones de tareas
Adaption Labs ha presentado "Invent a Dataset", una función que genera conjuntos de datos estructurados y listos para el entrenamiento directamente a partir de descripciones de tareas en lenguaje natural, sin necesidad de un corpus inicial, un esquema predefinido ni una guía de etiquetado. La herramienta está disponible a través de la aplicación Adaption, el SDK de Python y la API REST, permitiendo a los usuarios descargar las filas generadas en formatos JSONL, JSON, CSV o Parquet.
Qwen lanza Qwen3.8-Max-0902 con 2,4T parámetros y contexto de 1M
Alibaba ha lanzado una versión mejorada de su modelo de lenguaje grande, Qwen3.8-Max-0902. El nuevo modelo cuenta con 2,4 billones de parámetros y admite una ventana de contexto de 1 millón de tokens.
Tencent lanza el modelo MoE Hy4-preview con 770B de parámetros
El equipo Tencent Hy ha liberado como código abierto Hy4-preview, un nuevo modelo insignia Mixture-of-Experts de nueva generación que comprende 770B de parámetros totales con 49B activados por token. La arquitectura cuenta con 78 capas donde la primera utiliza una FFN densa y las restantes 77 usan MoE con 256 expertos enrutados, junto a una capa nativa MTP para decodificación especulativa.
Zhipu AI lanza GLM-5.3-Flash
Zhipu AI ha lanzado el modelo GLM-5.3-Flash, posicionándolo como una solución de inteligencia de vanguardia con capacidades de inferencia de bajo costo.
NVIDIA compra HuggingFace por $13B; Z.ai lanza GLM-5.3-Flash
Nvidia está adquiriendo HuggingFace por 13 mil millones de dólares, casi el doble de su oferta inicial de enero de 2026, ya que la plataforma duplica su base de clientes en 2026. Simultáneamente, Z.ai ha lanzado formalmente GLM-5.3-Flash, un modelo nativamente multimodal de pesos abiertos previamente conocido como Ox Alpha.