待验证50% 置信基准精确时间
在 DeepSWE 基准上各推理档位每任务成本分别为 Low $1、Medium $1.86、High $3.47、X-High $4.70、Max $8.39
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/14
首次发现
有效期至:2026/10/12
来源
相关事实
待验证在DeepSWE基准测试中,Opus 4.8单次运行约8美元,GLM 5.2 Max单次约4美元73% 相似待验证GPT-5.6 Sol 在 DeepSWE 基准 Max 档位取得 73% 的史上最高分,每任务成本 22 美元,而竞品 Fable 对应档位为 839 美元72% 相似待验证按照当前主流模型API定价,一次深度代码重构任务的成本可能在0.5-2美元之间71% 相似待验证在 DiD Suite 基准测试中,Max Effort 级别每个任务的平均成本高达 22 美元,而 Low 级别单任务成本仅为 3.76 美元,降幅超过 80%70% 相似部分验证DeepSeek的API输入token价格约为Claude Opus的1/50到1/10070% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/507955API
curl https://kongchang.com/api/v1/knowledge/claims/507955MCP
get_claim(id=507955)