待验证50% 置信事实精确时间
K2.7 Code目前尚未公布SWE-Bench成绩,所有性能数据均为月之暗面自报,此前K2.6曾出现自报成绩与第三方复现相差15-20个百分点的情况
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Kimi K2.7 Code深度解析:万亿参数编程模型的性价比之战
bilibiliAI睡前简报2026/6/13
相关事实
待验证K2.7 Code在MLS Bench Lite基准测试上相比K2.6提升31.5%(从26.7提升至35.1),是所有测试中提升幅度最大的70% 相似部分验证与K2.6相比,K2.7 Code在Kimi Code Bench VR基准测试上提升21.8%(从50.9提升至62.0)70% 相似待验证Kimi K2.7 Code在MCP Mark Verified基准测试上得分81.1,相比K2.6的72.8提升11.4%69% 相似已验证在Terminal Bench 2.0测试中,K2.6打出66.7分,比GPT-5.4和Claude Opus 4.6都略高68% 相似待验证Kimi K2.6在SWE-Bench Pro测试中获得58.6%的分数,位居开源模型第一66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/42607API
curl https://kongchang.com/api/v1/knowledge/claims/42607MCP
get_claim(id=42607)