Las noticias de IA de esta semana destacan importantes lanzamientos de modelos con pesos abiertos de Z.ai, Tencent y Alibaba, junto con avances en infraestructura de inferencia y evaluación de agentes.
- Z.ai lanzó GLM-5.3 con 744B parámetros totales para codificación agéntica y defensa cibernética, mientras que su variante Flash ofrece mayor calidad a menor costo.
- Tencent lanzó Hy4-preview, un modelo MoE de 770B que muestra ganancias sustanciales de rendimiento sobre Hy3 en tareas de generación de código.
- Alibaba presentó Qwen3.8-Flash, un modelo MoE de 125B diseñado para inferencia multimodal de contexto largo y bajo costo, aunque los primeros informes señalan problemas de estabilidad con la cuantización FP8.
- vLLM publicó benchmarks comparando métodos de decodificación especulativa, sin encontrar un ganador universal y enfatizando la sintonización específica para cada carga de trabajo.
- Alibaba Accio abrió el código fuente de CommerceAgentBench, un benchmark de 107 tareas que mide la finalización real de tareas en lugar de solo la calidad de la respuesta.
- La investigación de Google indica que las habilidades portátiles almacenadas en una wiki persistente se transfieren eficazmente entre familias de modelos, ofreciendo potencialmente capacidades de agente más robustas que el ajuste fino.