A Tencent liberou os pesos de seu modelo Hy4-preview, especificamente a variante 770B-A49B. O modelo agora está disponível no Hugging Face.
Tencent libera pesos do Hy4-preview 770B-A49B
Tencent lança modelo MoE Hy4-preview com 770B de parâmetros
A equipe Tencent Hy disponibilizou como código aberto o Hy4-preview, um novo modelo flagship Mixture-of-Experts de nova geração que compreende 770B de parâmetros totais, com 49B ativados por token. A arquitetura possui 78 camadas, onde a primeira utiliza uma FFN densa e as restantes 77 utilizam MoE com 256 especialistas roteados, além de uma camada MTP nativa para decodificação especulativa.
Tencent lança modelo MoE preview Hy4 com 770B de parâmetros
A equipe Tencent Hy disponibilizou como código aberto o Hy4 preview, um novo modelo flagship Mixture-of-Experts de nova geração que compreende 770B de parâmetros totais, com 49B ativados por token. A arquitetura possui 78 camadas, onde a primeira utiliza uma FFN densa e as restantes 77 usam MoE com 256 especialistas roteados, além de uma camada MTP nativa para decodificação especulativa.
Tencent lança o modelo de embedding multimodal WeMM-Embedding-2B
A Tencent lançou o WeMM-Embedding-2B, um modelo universal de embedding multimodal construído sobre o Qwen3.5 que aceita texto, imagens, vídeos, documentos visuais e entradas intercaladas para retornar embeddings L2-normalizados de 2.048 dimensões.
Tencent lança o modelo de embedding multimodal universal WeMM-Embedding-4B
A Tencent lançou o WeMM-Embedding-4B, um modelo de embedding multimodal universal baseado no Qwen3.5 que aceita texto, imagens, vídeos, documentos visuais e entradas intercaladas para retornar embeddings L2-normalizados de 2.560 dimensões.
Tencent lança o modelo de embedding multimodal universal WeMM-Embedding-9B
A Tencent lançou o WeMM-Embedding-9B, um modelo de embedding multimodal universal construído sobre o Qwen3.5 que aceita texto, imagens, vídeos, documentos visuais e entradas intercaladas para retornar embeddings L2-normalizados de 4.096 dimensões.