OpenAI推出的AI视频生成工具,采用视频扩散Transformer架构,能够理解物理世界的运动规律生成高质量视频
2024年OpenAI发布了Sora概念演示,引发行业军备竞赛
开源AI视频项目包括CogVideo、Open-Sora、Mochi等
即梦视频生成插件采用了类似Sora的视频大模型架构,在图像扩散模型基础上增加了时间维度的一致性约束
2024年以来,以Sora为代表的视频生成模型被认为是世界模型的雏形
OpenAI Sora于2024年发布,引发视频生成领域广泛关注
当前AI视频生成领域的主流视频生成模型包括OpenAI的Sora、快手的可灵(Kling)、Google的Veo以及Runway Gen-3
OpenAI 的 Sora 和快手的可灵(Kling)等视频生成模型也采用了类似 DiT 的技术路线
当前AI视频生成技术在生成超过一分钟的连贯视频时,普遍面临角色外观漂移、物理规律违反、动作不连贯等问题
即梦(Jimeng)更适合中文提示词,而Runway和Sora更适合英文描述
Elon Musk将Grok锁进付费墙,OpenAI也对Sora采取了付费策略
还有 18 条时间轴事件