待验证50% 置信观点精确时间
许多开源模型继承教师模型的自信偏差,导致工具调用错误时不愿自我纠正
1
来源数
50%
置信度
长期有效
时效性
2026/7/6
首次发现
来源
给开源模型加「修复层」:DeepSeek也能超越Claude Opus
bilibiliGelai_AI2026/7/5
相关事实
待验证蒸馏训练的教师模型输出极少包含自我纠错示例,导致学生模型形成「强模型不犯错」的隐性信念,在校验失败时选择重复而非修正82% 相似待验证多对一映射导致教师token间的不确定性在投影到学生第一个token时被直接加和抹平,这是投影方式的固有属性而非实现错误69% 相似待验证当模型缺乏某个库的准确知识时,倾向于生成语法正确但语义错误的代码,即'自信错误'69% 相似待验证作者认为开源模型工具调用表现差绝大多数情况下是框架的问题,而非模型本身的能力缺陷69% 相似待验证推理模型幻觉率上升的根本原因是激励机制错位:强化学习训练使模型倾向于生成详尽、有说服力的思维链,人类评估者给予论述详尽的回答更高评分,即使其中包含事实性错误68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/114162API
curl https://kongchang.com/api/v1/knowledge/claims/114162MCP
get_claim(id=114162)