待验证50% 置信事件精确时间
AMD 与 EmbeddedLLM 联合发布博客,记录了在 Instinct MI355X 硬件上优化 MiniMax M3 推理服务的过程
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/15
首次发现
有效期至:2026/12/14
来源
涉及实体
相关事实
待验证该基准测试在Gemma、Qwen、Kimi、MiniMax四类模型上,基于AMD Instinct MI300X与MI355X硬件进行75% 相似待验证MI355X属于AMD Instinct系列数据中心加速卡,基于CDNA架构演进而来74% 相似待验证AMD Instinct系列(如MI300X)通过ROCm软件栈实现与PyTorch、TensorFlow等主流AI框架的兼容73% 相似待验证AMD MI355X在硬件层面原生支持FP8计算,这是其相比上一代MI300X的重要能力升级72% 相似待验证AMD MI355X运行GLM5.2时实现了单节点2626 tokens/秒的推理吞吐量70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/921463API
curl https://kongchang.com/api/v1/knowledge/claims/921463MCP
get_claim(id=921463)