模型Video JEPA / V-JEPA模型
V-JEPA
Meta开发的视频理解模型,采用「联合嵌入预测架构」(Joint Embedding Predictive Architecture),试图捕捉视频中的结构化因果关系,是世界模型研究的重要探索
时间轴 (近 90 天)
9月12日
Meta AI Research已发布I-JEPA和V-JEPA等具体实现,在视觉自监督学习任务上取得了有竞争力的结果
待验证50%
9月6日
Meta研究团队提出的V-JEPA模型、Google DeepMind的Genie等项目在探索让AI建立对物理世界的内在模拟
待验证50%
9月5日
Yann LeCun提出JEPA框架,核心思想是在抽象的表征空间而非像素空间中进行预测,Meta已发布V-JEPA等早期实现
待验证50%
9月5日
V-JEPA由Meta AI于2024年发布,通过遮蔽视频中最高可达90%的时空区域训练模型在表征空间预测被遮蔽部分
待验证50%
7月17日
I-JEPA(图像版本)和 V-JEPA(视频版本)均由 Meta AI 发布并开源
待验证50%
全部知识事实 (5)
待验证
Meta研究团队提出的V-JEPA模型、Google DeepMind的Genie等项目在探索让AI建立对物理世界的内在模拟
50%待验证Yann LeCun提出JEPA框架,核心思想是在抽象的表征空间而非像素空间中进行预测,Meta已发布V-JEPA等早期实现
50%待验证I-JEPA(图像版本)和 V-JEPA(视频版本)均由 Meta AI 发布并开源
50%待验证Meta AI Research已发布I-JEPA和V-JEPA等具体实现,在视觉自监督学习任务上取得了有竞争力的结果
50%待验证V-JEPA由Meta AI于2024年发布,通过遮蔽视频中最高可达90%的时空区域训练模型在表征空间预测被遮蔽部分
50%