待验证75% 置信事实时间未知
GLM 5.1 High Speed声称在不降低模型能力的前提下实现400 token/s,突破点在于推理系统层面的工程优化而非模型压缩
1
来源数
75%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
GLM 5.1满血旗舰模型实测400 TPS,两分钟从草图到完整应用
bilibiliAI冷科长
涉及实体
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/6845API
curl https://kongchang.com/api/v1/knowledge/claims/6845MCP
get_claim(id=6845)