待验证50% 置信事实精确时间
据统计,NeurIPS 2023-2025期间与大语言模型相关的投稿量增长超过300%,而贝叶斯方法、核方法、概率图模型等传统方向的投稿占比持续下降
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/26
首次发现
有效期至:2026/11/24
来源
涉及实体
相关事实
待验证顶尖模型在SWE-bench上的解题率从2023年的不足5%跃升至2025年的30%以上68% 相似待验证在7个月研究期间,修Bug的会话比例从33%降到19%,运维从14%涨到21%,写文档和分析数据从10%涨到20%65% 相似待验证Anthropic在2023年的论文中系统测量了奉承偏差,发现即便在明显错误前提下多数主流模型仍有相当比例的回复选择顺从用户64% 相似待验证2023年的一项研究发现主流代码模型在生成API调用时的幻觉率可达15-25%,尤其在涉及较新或较冷门的库时更突出63% 相似待验证斯坦福大学2023年研究表明,即便是当时最先进的模型,在处理超过32K Token的上下文时,对中间段落的信息提取准确率会下降30%至50%62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/802162API
curl https://kongchang.com/api/v1/knowledge/claims/802162MCP
get_claim(id=802162)