对DeepSeek v4 Flash模型的初步测试表明,其用户界面和用户体验设计技能有显著增强。尽管有这些改进,但该模型被指出非常消耗token。
media
r/LocalLLaMA
·
1 小时前
·
open_models
DeepSeek v4 Flash的初步测试显示在UI/UX设计能力方面有显著提升
译自 English → 中文
相关文章
arxiv
arXiv cs.CL
·
4 天前
·
2 次浏览
PIVOT通过跨查询组共享前缀扫描来加速令牌级稀疏注意力
PIVOT(Proxy Indexing Via One full-prefix Traversal)是一种无需训练、可即插即用的DeepSeek稀疏注意力(DSA)索引器替代方案,它通过在邻近查询组间共享单次前缀扫描来减少计算冗余。PIVOT不再为每个查询单独对每个前置令牌进行评分,而是将查询组聚合为一个代理查询以获取候选集,随后从中为每个查询选出top-k个令牌。
lab
NVIDIA Research
·
4 天前
·
7 次浏览
用于基于2D高斯图像压缩的聚类码本量化
研究人员提出了Cluster-Guided Vector Quantization (CGVQ),这是一种旨在提高基于高斯基元图像压缩率失真性能的方法。该方法在量化之前将高斯参数划分为同质组,解决了为每个基元存储大量浮点参数导致的低效问题。
lab
Hugging Face Blog
·
9 天前
·
1 次浏览
Diffusers 新增原生 Nunchaku Lite 4-bit 推理支持
Hugging Face Diffusers 现在支持通过 `from_pretrained()` 原生加载 Nunchaku Lite 检查点,无需单独的推理引擎或本地 CUDA 编译。此集成利用 SVDQuant 方法运行具有 4-bit 权重和激活值(W4A4)的 Transformer 层,在显著降低内存使用的同时提高了推理速度。
media
Hugging Face Forums
·
16 天前
·
13 次浏览
用户请求为 FireRed Image Edit v1.1 提供 INT8 ConvRot 量化
Hugging Face 论坛的一位用户正在询问是否为 FireRed Image Edit v1.1 模型开发 INT8 或 FP8 ConvRot 版本的潜力。
media
r/LocalLLaMA
·
19 天前
·
3 次浏览
ZimengXiong 将 Hunyuan3D 移植到 MLX,支持 Apple Silicon 和 iPhone
开发者 ZimengXiong 完成了 Hunyuan3D-Paint 和 Hunyuan3D-Shape 模型的 Swift-MLX 和 Python MLX 移植,实现了在 Apple Silicon 设备上的本地图像到 3D 生成。该工作以开源 Modelr 桌面应用的形式分发,适用于 macOS 和 iOS,并附带将技术集成到 Swift 应用程序中的源代码。