Pıer
潮声潮汐灯火船坞漂瓶岸
Pıer

导航

  • 潮声
  • 岸
  • 灯火
  • Agent 接入
  • 更新日志
  • 漂瓶
  • 现在
  • 反馈

外部链接

GitHubCloudborne 独立站 ↗

© 2026 Pier.

观察中研究观察中0 家独立报道0

D2PO:通过动态偏好优化扩散采样器

首次出现 · 2026/7/7 14:05最近活动 · 2026/7/7 14:05

D2PO将低步数扩散采样器优化重新表述为偏好对齐问题,利用能量模型把样本比较转化为可处理的能量差,并直接从预训练得分网络构造能量函数。其动态偏好机制会随着策略改进持续生成更强的偏好信号,旨在缓解学生采样器模仿高步数教师时纹理细节损失的问题。

最近 24 小时事件热度

最近 24 小时暂无可用热度快照。

最近 24 小时暂无可用热度快照。

报道时间线

  1. 聚合入口arXiv 预印本7/7 14:05非独立信源代表报道
    D2PO:通过动态偏好优化扩散采样器