DeepSeek v4 Flashモデルの初期テストでは、ユーザーインターフェースおよびユーザーエクスペリエンスデザインのスキルに顕著な改善が見られます。これらの改善にもかかわらず、このモデルはトークンを大量に消費することが指摘されています。
DeepSeek v4 Flashの初期テストはUI/UXデザイン能力の大幅な向上を示す
PIVOTはクエリグループ間でプレフィックススキャンを共有し、トークンレベルのスパースアテンションを高速化する
PIVOT(Proxy Indexing Via One full-prefix Traversal)は、DeepSeek Sparse Attention(DSA)インデクサのためのトレーニング不要なドロップイン置換であり、近くのクエリグループ間で1つのプレフィックススキャンを共有することで計算の冗長性を削減します。各クエリに対して個別にすべての先行トークンをスコアリングする代わりに、PIVOTはグループを単一のプロキシクエリに集約して候補セットを取得し、そこから各クエリのためにトップkトークンが選択されます。
2Dガウスベース画像圧縮のためのクラスター化コードブック量子化
研究者らは、ガウスプリミティブベースの画像圧縮におけるレート歪み性能を向上させるために設計されたCluster-Guided Vector Quantization (CGVQ)を発表します。このアプローチは、量子化の前にガウスパラメータを均質なグループに分割し、各プリミティブあたりの大量の浮動小数点パラメータの保存による非効率性を解決します。
DiffusersがNunchaku Liteの4ビット推論をネイティブサポート
Hugging Face Diffusersは、`from_pretrained()`経由でNunchaku Liteチェックポイントをネイティブに読み込む機能を追加し、個別の推論エンジンやローカルCUDAコンパイルの必要性を排除しました。この統合ではSVDQuant方式を用いて4ビット重みと活性化(W4A4)によるTransformerレイヤーを実行し、メモリ使用量を大幅に削減しつつ推論速度を向上させます。
FireRed Image Edit v1.1のINT8 ConvRot量子化をユーザーがリクエスト
Hugging Faceフォーラムのユーザーは、FireRed Image Edit v1.1モデルに対するINT8またはFP8のConvRot版の開発の可能性について質問しています。
ZimengXiongがHunyuan3DをApple SiliconとiPhone向けにMLXへポート
開発者のZimengXiongは、Hunyuan3D-PaintおよびHunyuan3D-ShapeモデルのSwift-MLXおよびPython MLXへのポートを完了し、Apple Siliconデバイスでのローカルな画像から3Dへの生成を可能にしました。この取り組みは、macOSおよびiOS向けのオープンソースModelrデスクトップアプリとして配布されており、Swiftアプリケーションへの技術統合のためのソースコードも含まれています。