待验证50% 置信基准精确时间
社区测出V4.1 Flash峰值达400 token/秒的速度,即便上下文拉到100万token速度也变化不大
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证在双Spark系统上,DeepSeek V4 Flash(FP8量化)峰值约每秒53个Token74% 相似待验证DeepSeek V4 Flash在OpenModel平台的速率限制为每分钟10次请求(10 RPM)和每分钟100K tokens(100K TPM)74% 相似待验证在Artificial Analysis的成本基准中,DeepSeek V4 Flash位于成本最低区间,速度约110 tokens/s70% 相似待验证DeepSeek Flash模型每秒token输出可达100多70% 相似待验证在双Spark系统上,GLM 5.3 Flash峰值约每秒46个Token69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/900398API
curl https://kongchang.com/api/v1/knowledge/claims/900398MCP
get_claim(id=900398)