待验证75% 置信事实时间未知
在SWE-Bench编程基准测试中,Claude Code得分80.8%,GitHub Copilot仅为72.5%
1
来源数
75%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
微软封杀Claude Code:成本黑洞、产品落后与生态失控的三重困境
bilibiliNana的AI娜娜
涉及实体
相关事实
待验证在SWE-Bench基准测试中,Claude Code得分约80.9分83% 相似待验证Under Claude 3.7, GitHub Copilot ranked fourth, slightly below Zed's score of 678072% 相似已验证Devin在SWE-bench测试中解决了13.86%的真实GitHub Issues,高于Claude 2的表现70% 相似待验证SWE-Bench评测中,Claude Code得分59分,Codex得分56.8分67% 相似待验证通义千问3.6在SWE-Bench测试中得分78.8分,对比Claude Opus的80.9分65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/4841API
curl https://kongchang.com/api/v1/knowledge/claims/4841MCP
get_claim(id=4841)