Laboratorio · Tencent
lab Tencent Hunyuan (HF) · hace 14 h · 1 vista

Tencent lanza UI-Mate-27B, un agente de GUI de peso abierto con adaptación de flujo de trabajo guiado por demostraciones

El equipo HY Frontier Multimodal Agent Team de Tencent ha lanzado UI-Mate-27B, un agente de GUI base de peso abierto diseñado para tareas de largo alcance en aplicaciones y sistemas operativos. El modelo observa capturas de pantalla en vivo para razonar sobre los estados visibles y produce acciones estructuradas de teclado y ratón para la interacción nativa con el escritorio.

lab Tencent Hunyuan (HF) · hace 14 h · 1 vista

Tencent lanza UI-Mate-9B, un agente de GUI de peso abierto con uso asistido por demostración

El equipo Tencent HY Frontier Multimodal Agent Team ha lanzado UI-Mate-9B, un agente de GUI base de peso abierto diseñado para tareas de largo alcance en aplicaciones y sistemas operativos. El modelo observa capturas de pantalla en vivo para razonar sobre los estados visibles y produce acciones estructuradas de teclado y ratón para la interacción nativa con el escritorio.

arxiv arXiv cs.AI · hace 7 d · 14 vistas

MiLMMT-46-v1.0 mejora la traducción multilingüe mediante postentrenamiento sin referencia

Los investigadores han desarrollado MiLMMT-46-v1.0, un modelo de traducción automática multilingüe que aplica postentrenamiento sin referencia a modelos de lenguaje grandes de código abierto. El equipo utiliza Optimización de Política Relativa por Grupos (GRPO) con una recompensa basada en dos modelos de estimación de calidad sin referencia, controlada por identificación de idioma.

arxiv arXiv cs.CL · hace 7 d · 21 vistas

MiLMMT-46-v1.0 mejora la traducción multilingüe mediante postentrenamiento sin referencia

Los investigadores han lanzado MiLMMT-46-v1.0, un modelo de lenguaje grande de código abierto para traducción automática multilingüe que utiliza postentrenamiento sin referencia. Partiendo del MiLMMT-46-v0.1 ajustado por supervisión, el equipo aplicó la Optimización de Política Relativa por Grupos (GRPO) con una recompensa basada en dos modelos de estimación de calidad sin referencia controlados por identificación de idioma.

media MarkTechPost · hace 19 d · 23 vistas

Tencent lanza AngelSpec, un marco de entrenamiento unificado para MTP y descodificación especulativa en paralelo por bloques

Tencent ha liberado como código abierto AngelSpec, un marco de entrenamiento nativo de torch que soporta tanto la predicción multi-token autoregresiva (MTP) como los drafters de la familia DFlash en bloque-paralelo para modelos Hy3. El sistema trata la heterogeneidad de la carga de trabajo como una restricción de diseño principal, lo que le permite especializar la estructura, los datos de entrenamiento y la profundidad de verificación según casos de uso específicos.