Laboratoire · Tencent
lab Tencent Hunyuan (HF) · il y a 5 h

Tencent publie UI-Mate-democua-27B avec des capacités d'agent GUI guidé par démonstration

Tencent a publié le checkpoint UI-Mate-democua-27B, une version guidée par démonstration de son agent GUI UI-Mate capable d'adapter les workflows enregistrés à de nouvelles tâches. Le modèle observe des captures d'écran en direct et raisonne sur les états visibles pour produire des actions structurées, en utilisant des démonstrations comme guide plutôt que des scripts fixes.

media r/LocalLLaMA · il y a 11 h · 1 vue

Tencent publie l'agent GUI UI-Mate-27B à poids ouverts

Tencent a publié UI-Mate-27B, un modèle de base à poids ouverts conçu pour l'utilisation prolongée de l'ordinateur à travers les applications et les systèmes d'exploitation. Le modèle de 27 milliards de paramètres observe des captures d'écran en direct pour raisonner sur les états visibles et produit des actions structurées de clavier et de souris pour l'interaction native avec le bureau.

lab Tencent Hunyuan (HF) · il y a 14 h · 1 vue

Tencent publie UI-Mate-27B, un agent GUI à poids ouvert avec adaptation de flux de travail guidée par démonstration

L'équipe Tencent HY Frontier Multimodal Agent a publié UI-Mate-27B, un agent GUI fondamental à poids ouvert conçu pour des tâches à long terme sur des applications et des systèmes d'exploitation. Le modèle observe des captures d'écran en direct pour raisonner sur les états visibles et produit des actions de clavier et de souris structurées pour l'interaction native sur bureau.

lab Tencent Hunyuan (HF) · il y a 14 h · 1 vue

Tencent lance UI-Mate-9B, un agent GUI à poids ouvert avec utilisation guidée par démonstration

L'équipe Tencent HY Frontier Multimodal Agent Team a lancé UI-Mate-9B, un agent de base GUI à poids ouvert conçu pour des tâches à long terme sur les applications et les systèmes d'exploitation. Le modèle observe des captures d'écran en direct pour raisonner sur les états visibles et produit des actions structurées de clavier et de souris pour l'interaction native avec le bureau.

arxiv arXiv cs.AI · il y a 7 j · 14 vues

MiLMMT-46-v1.0 améliore la traduction multilingue grâce à un post-entraînement sans référence

Des chercheurs ont développé MiLMMT-46-v1.0, un modèle de traduction automatique multilingue qui applique un post-entraînement sans référence aux grands modèles de langage ouverts. L'équipe utilise l'optimisation de politique relative par groupe (GRPO) avec une récompense basée sur deux modèles d'estimation de la qualité sans référence, contrôlée par l'identification de la langue.

arxiv arXiv cs.CL · il y a 7 j · 21 vues

MiLMMT-46-v1.0 améliore la traduction multilingue grâce à un post-apprentissage sans référence

Les chercheurs ont publié MiLMMT-46-v1.0, un grand modèle de langage ouvert pour la traduction automatique multilingue qui utilise un post-apprentissage sans référence. À partir du MiLMMT-46-v0.1 finement ajusté par apprentissage supervisé, l'équipe a appliqué l'optimisation relative de politique de groupe (GRPO) avec une récompense basée sur deux modèles d'estimation de la qualité sans référence, contrôlés par identification de la langue.

media MarkTechPost · il y a 19 j · 23 vues

Tencent publie AngelSpec, un cadre d'entraînement unifié pour MTP et le décodage spéculatif bloc-parallèle

Tencent a open-sourcé AngelSpec, un framework d'entraînement natif torch qui prend en charge à la fois la prédiction multi-jeton autoregressive (MTP) et les drafters de famille DFlash bloc-parallèles pour les modèles Hy3. Le système traite l'hétérogénéité des charges de travail comme une contrainte de conception principale, lui permettant de spécialiser la structure, les données d'entraînement et la profondeur de vérification en fonction de cas d'utilisation spécifiques.