跳到正文
原文
OpenAI News·· 2024-02-15精选AI 评分88

OpenAI 研究:视频生成模型可作为世界模拟器

Video generation models as world simulators

AI 导读

OpenAI 探索在视频数据上大规模训练生成模型,将文本条件扩散模型联合训练于不同时长、分辨率和宽高比的视频与图像,并采用在视频和图像潜码时空 patch 上运行的 Transformer 架构。其最大模型 Sora 能生成一分钟高保真视频,结果提示扩展视频生成模型是构建通用物理世界模拟器的一条可行路径。

推荐理由

OpenAI 公开了视频生成模型的训练思路,读者可了解扩散模型与 Transformer 如何被用于构建物理世界模拟器。

来源:OpenAI News · openai.com