mlx engine: long-lived runner (keep_alive -1) returns a different prompt answer on repeat calls — cross-request response contamination

在 Ollama MLX 引擎(Apple Silicon)下,当使用 OLLAMA_KEEP_ALIVE=-1 让模型常驻内存时,长生命周期 runner 在重复调用中可能返回“之前某个请求的完整答案”,即跨请求响应污染( mlx engine: long-lived runner (keep_a








