待验证50% 置信事实精确时间
MATH数据集由Hendrycks等人于2021年发布,包含12500道竞赛数学题目并按难度分为5级
1
来源数
50%
置信度
长期有效
时效性
2026/8/27
首次发现
来源
涉及实体
相关事实
待验证MMLU于2021年由Hendrycks等人提出,题目来源于真实人类专业考试,覆盖57个学科领域63% 相似待验证GAIA基准测试由Meta AI和HuggingFace等团队于2023年提出,包含400多个精心设计的问题62% 相似待验证MMLU于2021年由Dan Hendrycks等人发布,涵盖57个学科共14,000余道题目62% 相似待验证2024年OpenAI发布的o1技术报告明确展示了推理Token数量与AIME数学竞赛得分之间近乎线性的正相关关系62% 相似待验证MMLU由Dan Hendrycks等人于2020年提出,覆盖57个学科,测试模型在零样本和少样本条件下的泛化能力61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/807967API
curl https://kongchang.com/api/v1/knowledge/claims/807967MCP
get_claim(id=807967)