[控场AI]
模型MiniMax H3

MiniMax-H3

MiniMax发布的多模态视频生成模型,能够在单次请求中同时生成视频和同步立体声音轨,支持文本转视频加音频、首尾帧条件生成、图像/视频/音频参考条件生成等多种任务模式

时间轴 (近 90 天)

9月11日

一位Reddit用户发布了针对MiniMax-H3的第二轮物理知识测试

待验证50%
9月11日

该物理测试的方法是使用公开的倒水视频,将画面中的水替换成不同物质,观察模型处理这些物质被倾倒时的行为

待验证50%
9月11日

第一轮实验聚焦于液体换液体,第二轮实验将测试对象升级为固体甚至活体对象

待验证50%
9月11日

固体在倾倒时的行为比液体更加多样化和离散,模型需根据物体隐含材质属性选择不同的物理响应模式

待验证50%
9月11日

作者指出相较于其他开源权重模型,MiniMax-H3的表现是一次大的飞跃(a big leap forward)

待验证50%
9月11日

MiniMax-H3在处理多个物体发生重叠(overlap)的场景时表现明显下降,依然挣扎很多

待验证50%
9月11日

通过保持场景不变、只替换关键对象的对比实验,可以在受控条件下观察模型的物理推理能力

待验证50%
9月11日

作者表示仍在深入探索该模型,并计划发布更多实验,下次不再使用水

待验证50%

全部知识事实 (8)

来源文章