快速结论:在 vLLM 对称 P2P KV offload 模式下,若同一 kv_request_id 经历多次 lookup→fetch 轮次,consumer 可能因 producer 端状态被意外清空而等待 30 秒超时。优先排查是否是 _OutboundRequestState 在轮次间被 _finalize_outbound() 清空导致 supply 丢失。
适用环境:vLLM(版本接近 nightly-1240c74c 或更高,含 #49820 修复前);对称 P2P(symmetric P2P)模式;多节点部署。
最快修复方案:为 LookupMsg 和 FetchMsg
参考来源
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。
![Bug: [vulkan] llama.cpp not work on Raspberry Pi 5](https://www.chat-gpts.plus/wp-content/uploads/2026/07/9801-8ecbd60c-768x403.jpg)

![Agent Node InvokeError: [models] Error: 'required'](https://www.chat-gpts.plus/wp-content/uploads/2026/07/39274-3d3282fa-768x403.jpg)