待验证50% 置信权衡取舍精确时间
多个Agent组成协作网络时可能出现'幻觉传染',即一个Agent生成的错误信息被另一个Agent当作事实接收并进一步推理,导致错误在网络中扩散
1
来源数
50%
置信度
长期有效
时效性
2026/9/8
首次发现
来源
涉及实体
相关事实
待验证Agent中的幻觉会直接变成错误的动作,包括调用不存在的工具、编造文件内容、虚构错误信息并据此执行后续操作70% 相似待验证Agent链式调用多个技能时,若某个技能被恶意构造或存在漏洞,可能引发提示注入攻击(Prompt Injection)66% 相似待验证Agent行为链路本质上是概率性推理过程,相同输入可能产生不同的工具调用序列,这是Agent评估的难点66% 相似待验证多Agent循环协作模式中,生成Agent产出初稿、批评Agent指出问题、修订Agent整合反馈,三者形成多轮迭代协作循环63% 相似已验证间接提示注入的原理是攻击者将恶意指令伪装成正常数据,通过Agent信任的数据源传递给模型,诱使模型将数据解读为指令并执行62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/877468API
curl https://kongchang.com/api/v1/knowledge/claims/877468MCP
get_claim(id=877468)