待验证50% 置信观点精确时间
同一个 Agent 写完代码再自审存在类似人类确认偏误(Confirmation Bias)的问题,是认知心理学现象在 AI 系统中的映射
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Claude Code + Codex:一写一审的AI编程最佳实践
bilibiliAli厂长2026/6/3
相关事实
待验证ThoughtWorks研讨会发现AI存在'作弊代理'问题:AI写出有问题的代码,同时写出同样有问题的测试,让坏代码看起来通过了验证77% 相似待验证谄媚的AI可能充当'确认偏误放大器',强化用户的认知偏差77% 相似待验证曝光偏差(Exposure Bias)是AI幻觉的根因之一:训练时模型看到的是真实文本作为上文(Teacher Forcing),推理时却要基于自己生成的内容继续生成,导致错误累积放大77% 相似待验证AI Agent在多平台场景下可能出现默认偏好导致的误判,作者纠正Agent误投飞书后改投微信才成功74% 相似待验证让同一个 AI 既写代码又测试代码,本质上是自己批改自己的作业,可能系统性忽略认知盲区中的 bug74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/52783API
curl https://kongchang.com/api/v1/knowledge/claims/52783MCP
get_claim(id=52783)