Same server, no num_ctx: some models return HTTP 400 naming 4096, others return 200 with prompt_eval_count 2050

这个报错发生在 Ollama 0.32.9(Windows,GGUF,POST /api/chat)同一服务器上,不同模型对超长 prompt(约 7.9k tokens)响应不一致:部分模型返回 HTTP 400 提示上下文不足(4096),而另一些返回 HTTP 200 但静默截断 prompt



![[Bug]: `/v1/responses` can replay `chatcmpl-*` message IDs into OpenAI Responses during cross-provider handoffs](https://www.chat-gpts.plus/wp-content/uploads/2026/08/27333-72c0e243-768x403.jpg)


![[deepseek-v4-flash-sm86 fork] PP8 + DSpark: recurring deadlock in the V2-runner PP sampled-token/draft broadcast protocol (PPHandler)](https://www.chat-gpts.plus/wp-content/uploads/2026/08/53402-1007c917-768x403.jpg)

