待验证50% 置信事实精确时间
vLLM在前缀缓存与DFlash2同时开启时存在bug,会将最后一个缓存单元(约16 token的混合布局块)直接丢弃并重新计算
1
来源数
50%
置信度
短期 (~14 天)
时效性
2026/9/6
首次发现
有效期至:2026/9/20
来源
涉及实体
相关事实
待验证vLLM、TensorRT-LLM等LLM推理服务通过KV Cache机制在单次请求内缓存中间注意力计算结果,但该缓存是请求级别的,HTTP连接关闭后即被释放70% 相似待验证该方案通过 Proxy 与 vm 模块结合,将脚本的属性未定义错误转化为可结构化处理的访问记录日志,从而系统性输出所有缺失项62% 相似待验证2015年曝光的VENOM漏洞(CVE-2015-3456)通过向QEMU模拟的虚拟软盘控制器发送特制I/O命令触发堆溢出,实现从Guest到Host的完整VM逃逸61% 相似待验证OPcache缓存的是虚拟机字节码而非机器码,执行时仍需Zend VM解释调度61% 相似待验证vLLM采用PagedAttention技术管理KV Cache,其内存分配与请求调度引入运行时不确定性61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/864434API
curl https://kongchang.com/api/v1/knowledge/claims/864434MCP
get_claim(id=864434)