ラボ · Tencent
arxiv arXiv cs.CL · 5日前 · 8 回表示

KuaFuは十億規模でユーザー行動を理解に圧縮する

Tencentは、生のユーザー履歴を会話エージェントやレコメンダーのためのコンパクトな表現に凝縮する統一された行動圧縮レイヤーであるKuaFuを導入しました。このシステムは2軸プロジェクターを使用して、各行動アイテムを幅128-256の2〜4トークンに圧縮し、十億人のユーザーに対する長いシーケンスの処理におけるボトルネックに対処します。

media r/LocalLLaMA · 15日前 · 25 回表示

Naive AI、評価額14億ドル、オープンウェイトLLMリリースを計画

清華大学の戴繼峰教授によって設立されたシークレットスタートアップのNaive AIは、総額4億ドルの3回の資金調達ラウンドを完了し、評価額が14億ドルを超えました。同社は、今月にもオープンウェイトリリースとして初の大型言語モデル「Naive」をリリースする準備をしています。

lab Tencent Hunyuan (HF) · 16日前 · 82 回表示

TencentがWeVisDoc-4Bをリリース、エンドツーエンドのドキュメントパーサー

Tencentは、ページ画像用のエンドツーエンドのドキュメントパーサーであるWeVisDoc-4Bをリリースしました。これは、LaTeX数式とHTMLテーブルを含む構造化されたMarkdownにページを変換します。Qwen3-VL-4B-Instructからファインチューニングされ、OmniDocBench v1.6で総合スコア95.38を達成し、報告されたすべての4つの設定において比較されたパーサーの中で1位となりました。

lab Tencent Hunyuan (HF) · 19日前 · 21 回表示

TencentがQwen3用のSimple Attention Sparsificationチェックポイントをリリース

Tencentは、Qwen3モデルの各クエリに対してKVブロックをランク付けおよび選択する方法を学習するSimple Attention Sparsification (SAS) チェックポイントをリリースしました。密集なアテンションスコアを蒸留する手法とは異なり、SASは選択されたブロックに連続ゲートを追加し、言語モデリング損失によるコンテキストランクのエンドツーエンド最適化を可能にします。