Laboratoire · Tencent
arxiv arXiv cs.CL · il y a 5 j · 8 vues

KuaFu compresse le comportement utilisateur en compréhension à l'échelle du milliard

Tencent présente KuaFu, une couche unifiée de compression du comportement qui condense l'historique brut de l'utilisateur en représentations compactes pour les agents conversationnels et les recommandeurs. Le système utilise un projecteur à deux axes pour compresser chaque élément de comportement en 2-4 tokens de largeur 128-256, adressant les goulots d'étranglement dans le traitement des séquences longues pour un milliard d'utilisateurs.

media r/LocalLLaMA · il y a 15 j · 25 vues

Naive AI évaluée à 1,4 milliard de dollars, prévoit le lancement d'un LLM à poids ouvert

Naive AI, une startup en mode furtif fondée par le professeur Dai Jifeng de l'Université Tsinghua, a complété trois tours de financement totalisant 400 millions de dollars, atteignant une valorisation de plus de 1,4 milliard de dollars. L'entreprise se prépare à lancer son premier grand modèle de langage, également nommé Naive, en tant que version à poids ouvert dès ce mois-ci.

lab Tencent Hunyuan (HF) · il y a 16 j · 82 vues

Tencent lance WeVisDoc-4B, un analyseur de documents de bout en bout

Tencent a lancé WeVisDoc-4B, un analyseur de documents de bout en bout pour les images de pages qui convertit les pages en Markdown structuré avec des formules LaTeX et des tableaux HTML. Fine-tuné à partir de Qwen3-VL-4B-Instruct, le modèle atteint un score global de 95,38 sur OmniDocBench v1.6 et se classe premier parmi les analyseurs comparés dans les quatre configurations rapportées.

lab Tencent Hunyuan (HF) · il y a 19 j · 21 vues

Tencent publie les checkpoints de Simple Attention Sparsification pour Qwen3

Tencent a publié des checkpoints de Simple Attention Sparsification (SAS) qui apprennent à classer et sélectionner des blocs KV pour chaque requête dans les modèles Qwen3. Contrairement aux méthodes qui distillent les scores d'attention dense, SAS ajoute des portes continues aux blocs sélectionnés, permettant l'optimisation de bout en bout du classement du contexte avec la perte de modélisation du langage.

lab Tencent Hunyuan (HF) · il y a 26 j · 32 vues

Tencent publie EVIE-8B, un modèle de récupération de documents visuels à 4096D

Tencent a publié EVIE-8B, un modèle de récupération de documents visuels à haute capacité présentant des représentations de tokens en 4096 dimensions et une attention bidirectionnelle complète. Le modèle sert de base enseignante pour la variante légère EVIE-4.5B Prefix-MRL et atteint des performances de pointe sur les benchmarks de récupération de documents visuels.