Tencentは、そのHy4-previewモデルの重み、具体的には770B-A49Bバリアントをリリースしました。このモデルは現在Hugging Faceで利用可能です。
TencentがHy4-preview 770B-A49Bの重みを公開
Tencentが770BパラメータのHy4-preview MoEモデルをリリース
Tencent Hyチームは、770Bの総パラメータを持ち、1トークンあたり49Bが活性化される新世代のMixture-of-ExpertsフラッグシップモデルであるHy4-previewをオープンソース化した。アーキテクチャは78層で構成され、最初の層は密なFFNを使用し、残りの77層は256のルーティング済みエクスパートを持つMoEを採用しており、さらに推論デコーディング用のネイティブMTP層も備えている。
騰訊が770BパラメータのHy4プレビューMoEモデルを公開
騰訊Hyチームは、総パラメータ数770B、1トークンあたり49Bが活性化される新世代Mixture-of-ExpertsフラッグシップモデルであるHy4プレビューをオープンソース化した。アーキテクチャは78層で、最初の層は密なFFNを使用し、残りの77層は256のルーティング済みエキスパートを持つMoEを採用し、推論デコーディング用のネイティブMTP層も備えている。
TencentがWeMM-Embedding-2Bマルチモーダル埋め込みモデルをリリース
Tencentは、Qwen3.5を基盤としたユニバーサルマルチモーダル埋め込みモデルであるWeMM-Embedding-2Bをリリースしました。このモデルはテキスト、画像、動画、視覚文書、インターリーブされた入力を接受し、2,048次元のL2正規化埋め込みを返します。
Tencentが汎用マルチモーダル埋め込みモデルWeMM-Embedding-4Bをリリース
Tencentは、Qwen3.5を基盤とした汎用マルチモーダル埋め込みモデルWeMM-Embedding-4Bをリリースしました。このモデルはテキスト、画像、動画、視覚文書、インターリーブされた入力を接受し、2,560次元のL2正規化埋め込みを返します。
TencentがWeMM-Embedding-9B汎用マルチモーダル埋め込みモデルをリリース
Tencentは、Qwen3.5を基盤とした汎用マルチモーダル埋め込みモデルWeMM-Embedding-9Bをリリースしました。このモデルはテキスト、画像、動画、視覚文書、インターリーブされた入力を接受し、4,096次元のL2正規化埋め込みを返します。