待验证50% 置信事实精确时间
MiniMax H3 架构用统一的 Transformer 骨干同时处理文本、图像和视频等不同模态的条件输入,H3 中的'H'通常指代混合注意力(Hybrid Attention)机制,结合局部窗口注意力与全局注意力
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
已验证H3 Minimax是Minimax公司的视频生成引擎,采用了稀疏注意力(Sparse Attention)机制77% 相似待验证主流视频生成模型(包括 MiniMax H3)通常通过注意力机制同时处理参考帧的外观特征和运动特征,不区分借鉴动作与保留画风73% 相似待验证创作者在MiniMax H3的Ref2V(参考图到视频)管线上应用了SLA注意力71% 相似已验证MiniMax-H3具备图像到视频(Image-to-video)和基于参考的生成(reference-based generation)两项能力70% 相似待验证Minimax是字节跳动旗下的多模态大模型,H3代表其图像生成版本69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/924050API
curl https://kongchang.com/api/v1/knowledge/claims/924050MCP
get_claim(id=924050)