待验证50% 置信基准精确时间
在15场真实工作场景评测中,GPT-6 Astra赢下10场,Claude Fable 5.1赢下5场
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/9
首次发现
有效期至:2026/9/23
来源
涉及实体
相关事实
待验证根据Artificial Analysis数据,GPT-6 Astra在智能指数上得分为61,与GPT-5.6 Sol持平,比Claude Fable 5.1低5分75% 相似待验证在浏览器操作能力上,GPT系模型(基于Codex的GPT-6 Astra)明显强于Claude Fable 5.1,在Canva临摹和Skool课程批量创建两个场景中均以压倒性优势胜出71% 相似待验证在Agent能力测试LexExam中,GPT-5.6 Soul比Anthropic的Claude Fable 5高出13.1分69% 相似部分验证三个 GPT-5.6 模型在长程代理微调任务上均拿满分 10 分,而 GPT-5.5 和 Opus 4.7 在该任务只能拿两三分67% 相似待验证在DeepSWE基准测试中,GPT 5.5以约70%的通过率高居榜首,比Opus 4.7领先超过15个百分点66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/881463API
curl https://kongchang.com/api/v1/knowledge/claims/881463MCP
get_claim(id=881463)