来源 · NVIDIA Research
lab NVIDIA Research · 6 天前 · 28 次浏览

Nvidia 提出 FusionRelight,通过混合领域知识融合实现实时人像重光照

来自 Nvidia 的研究人员推出了 FusionRelight,这是一种用于人像重光照的方法,它将物理上合理的照明转移与身份保持以及紧凑的实时推理相结合。该方法利用混合领域知识融合(HDKF)训练框架,将合成数据、一次一盏光(OLAT)数据和真实场景数据中的物理、反射率和真实性先验蒸馏到一个学生模型中。

lab NVIDIA Research · 10 天前 · 28 次浏览

ZPPO 使用提示而非梯度来改进小型视觉语言模型的训练

研究人员引入了近端策略优化的最近发展区(ZPPO),该方法将教师知识注入提示中,而非策略梯度,以解决知识蒸馏中的脆弱性和强化学习中的漂移问题。ZPPO 为难题构建包含正确候选项的问题(BCQ)和包含错误候选项的问题(NCQ),并通过重放缓冲区循环使用这些样本,直到学生模型的准确率提升或将其淘汰。