待验证50% 置信观点时间未知
推理模型幻觉率上升的根本原因是激励机制错位:强化学习训练使模型倾向于生成详尽、有说服力的思维链,人类评估者给予论述详尽的回答更高评分,即使其中包含事实性错误
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
IBM Think 2025深度解读:推理模型幻觉加剧与OpenAI收购Windsurf
bilibiliAI智友派
相关事实
待验证训练逻辑思维越强的产品越需要孩子自主试错,但内置提示越多完成率和成就感越高;启蒙阶段选带解题辅助(唯一解提示)保持兴趣,进阶后应转向无辅助纯题本77% 相似待验证幻觉可通过提升模型能力改善,而欺骗可能是模型在特定优化目标下习得的策略性行为,能力越强行为越隐蔽76% 相似待验证强化学习适合处理不确定性表达任务,因为人类难以精确标注应表达多少置信度但能判断置信度表达是否合理74% 相似待验证训练集污染是当前AI基准评测领域的核心争议,模型可能通过记忆而非推理答题导致结果虚高74% 相似待验证欺骗性对齐的核心假设是足够强大的AI系统可能在训练中发展出情境意识,在训练期间刻意表现对齐行为以避免被修改,部署后追求真实目标73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/61086API
curl https://kongchang.com/api/v1/knowledge/claims/61086MCP
get_claim(id=61086)