跳到正文
原文
_akhaliq· @_akhaliq · X·· 3 天前AI 评分24

音视频扩散模型动态多奖励优化研究

AI 导读

自适应奖励路由 通过前向过程 RL 实现联合音视频扩散的动态多奖励优化 论文:huggingface.co/papers/2609.3…

正文 · AI 翻译

自适应奖励路由

面向联合音视频扩散的动态多奖励优化:基于前向过程的强化学习

论文:huggingface.co/papers/2609.3…

来源:_akhaliq · x.com