待验证50% 置信基准精确时间
在盲测中Sol给Opus方案打8.3分、给Fable方案打6.0分
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/23
首次发现
有效期至:2026/11/21
来源
涉及实体
相关事实
待验证在前端与视觉任务(Three.js、SVG等)中Sol仅得6至7分,而Fable 5能稳定拿到9至10分,前端仍是OpenAI的弱项69% 相似待验证在ARC-AGI-3上Sol Max达到接近8%,而Opus和Gemini均低于1%67% 相似待验证在Artificial Analysis的Omniscience幻觉指标上,GPT-5.6 Sol Max高达89%,高于Claude Fable的55%和GLM 5.2的28%66% 相似待验证Opus 5在AI Omniscience测试拿了31分,避免瞎编的能力优于Opus 4.864% 相似待验证Sol 在编程智能体指数全推理模式下拿到 80 分,刷新 SOTA,比 Faber-5 高 2.8 分64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/788652API
curl https://kongchang.com/api/v1/knowledge/claims/788652MCP
get_claim(id=788652)