_akhaliq· @_akhaliq · X·2026-10-03 01:54· 3 天前AI 评分24音视频扩散模型动态多奖励优化研究AI 导读自适应奖励路由 通过前向过程 RL 实现联合音视频扩散的动态多奖励优化 论文:huggingface.co/papers/2609.3…正文 · AI 翻译中文原文自适应奖励路由面向联合音视频扩散的动态多奖励优化:基于前向过程的强化学习论文:huggingface.co/papers/2609.3…来源:_akhaliq · x.com#论文/研究#多模态#视频#推理查看事件全部后续