待验证50% 置信事实精确时间
在多轮Agent对话中,由于需要携带工具调用结果、历史上下文和系统提示,Token消耗往往是普通对话的5-10倍。
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Hermes Agent本地部署教程:内置代码能力与自我进化的AI助手框架
bilibili学大模型的小爆2026/6/10
相关事实
待验证在长对话中历史消息会被反复纳入上下文,导致每轮交互的token消耗持续增长,第10轮对话的实际计费包含前9轮全部文本81% 相似待验证多轮对话中Token用量会因携带完整历史上下文而随对话轮次呈线性增长80% 相似待验证在一个对话窗口里,提问轮次越多,后面每一轮消耗的Token就越大,因为历史对话会被拼接重新发送79% 相似待验证在多轮对话场景中,随着历史消息累积,系统指令相对业务内容的比重下降,格式遵从度随之降低71% 相似待验证Traditional conversational AI typically has a context window of a few thousand to tens of thousands of tokens68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/49755API
curl https://kongchang.com/api/v1/knowledge/claims/49755MCP
get_claim(id=49755)