Laboratorio · Alibaba (Qwen)
media AI News (smol.ai) · hace 5 d Terminal-Bench 2 · 67.4% · 8 vistas

Alibaba anuncia Qwen3.8-Max con 2.4T parámetros y pesos abiertos próximamente

Alibaba ha anunciado Qwen3.8-Max como su nuevo modelo insignia, describiéndolo como una arquitectura dispersa de 2.4T parámetros centrada en trabajo agénico de largo alcance, codificación y razonamiento multimodal. La compañía confirmó que los pesos abiertos para Qwen3.8-Max se lanzarán la próxima semana junto con la variante de pesos abiertos Qwen3.8-27B.

arxiv arXiv cs.LG · hace 6 d OSWorld 2.0 · 21.2% · 6 vistas

Qwen lanza Qwen-CUA, un agente de uso nativo del ordenador de 397B-A17B

Qwen presenta Qwen-CUA, un agente de uso nativo del ordenador basado en una columna vertebral de mezcla de expertos de 397B-A17B que opera mediante capturas de pantalla y eventos de entrada sin depender de árboles DOM ni metadatos de accesibilidad. El sistema utiliza un andamio para mantener hasta 20 capturas de pantalla activas y fue entrenado utilizando una flota de despliegue en la nube con casi 100.000 vCPUs a lo largo de aproximadamente 40.000 tareas verificables.

arxiv arXiv cs.AI · hace 10 d WebArena · 73.6% · 3 vistas

Qwen-UI-Agent establece el estado del arte en pruebas de uso móvil

El equipo de Qwen ha publicado un informe técnico para Qwen-UI-Agent, un agente GUI fundamental centrado en el mundo real diseñado para operar de forma fiable en entornos móviles, de uso en computadora, web y DeepSearch. El sistema combina diversos entornos de sandbox con una ejecución móvil a gran escala en dispositivos reales, intercalando operaciones GUI con ejecución CLI y apoyando tareas de largo alcance.

arxiv arXiv cs.CL · hace 12 d

Relay-OPD reduce la longitud de la trayectoria de entrenamiento en más del 50% en la destilación on-policy

Los investigadores introducen Relay On-Policy Distillation (Relay-OPD) para abordar el fallo de prefijo en la destilación on-policy estándar, donde los errores del estudiante conducen a una supervisión poco fiable. El método utiliza una asimetría de continuación maestro-estudiante como disparador para que el maestro tome brevemente el control y redirija la trayectoria antes de que el estudiante retome.

media r/LocalLLaMA · hace 12 d · 6 vistas

Microsoft lanza Mage-VL, un modelo multimodal de streaming nativo de códec

Microsoft ha lanzado Mage-VL, un modelo base multimodal eficiente de 4B de parámetros para la comprensión de imágenes y video que utiliza un enfoque nativo de códec para optimizar el procesamiento visual. El sistema separa los flujos de video en fotogramas ancla (I) y predichos (P), conservando solo los parches donde el códec asigna bits para reducir el consumo de tokens visuales en más del 75%.