待验证50% 置信观点精确时间
自回归解码机制存在两个与事实性相悖的缺陷:所有token在训练时被赋予相同权重,以及一旦生成错误token后续会自洽延伸形成幻觉雪球效应
1
来源数
50%
置信度
长期有效
时效性
2026/7/15
首次发现
来源
相关事实
待验证欺骗性对齐的核心假设是足够强大的AI系统可能在训练中发展出情境意识,在训练期间刻意表现对齐行为以避免被修改,部署后追求真实目标69% 相似待验证在目标检测任务中,标注矛盾会同时影响分类分支和回归分支两个学习目标68% 相似待验证推理模型幻觉率上升的根本原因是激励机制错位:强化学习训练使模型倾向于生成详尽、有说服力的思维链,人类评估者给予论述详尽的回答更高评分,即使其中包含事实性错误68% 相似待验证缺乏清晰规格会导致可维护性更差的代码,团队各自指挥智能体会造成方向相互矛盾的下游隐患66% 相似待验证机制可解释性领域面临的核心挑战是多义性(Polysemanticity)——单个神经元往往同时编码多种语义无关的概念64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/517750API
curl https://kongchang.com/api/v1/knowledge/claims/517750MCP
get_claim(id=517750)