已验证90% 置信事实时间未知
2012年AlexNet在ImageNet大规模视觉识别挑战赛(ILSVRC)中以超出第二名近11个百分点的优势夺冠,将Top-5错误率从26%降至15.3%
7
来源数
90%
置信度
长期有效
时效性
2026/5/31
首次发现
来源
AI预测中的"方向性准确":为什么比精确预测更有价值
twitterlevelsio
涉及实体
相关事实
已验证ResNet在ImageNet竞赛中以3.57%的top-5错误率夺冠,首次超越人类水平(约5.1%)67% 相似待验证最大effort设置下Opus 4.5超越Sonnet 4.5达4.3个百分点,同时仍减少48%的token56% 相似待验证Pace AI公司在保险问答基准测试中使用Sonnet 4.6达到了94%的准确率55% 相似待验证Muse Glimmer在MCP Atlas工具调用基准得分75.5,领先Qwen 3.6;智能体搜索任务74.6分;数学推理AIME 94.7分53% 相似待验证Gemma 4 31B 的综合能力评分达到 11,452 分,在同级别模型中处于领先地位53% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/7296API
curl https://kongchang.com/api/v1/knowledge/claims/7296MCP
get_claim(id=7296)