快速结论:这个报错发生在 Ollama 的 /v1/responses 端点收到来自 Codex CLI 的请求时,模型 qwen3.8:27b-mlx(MLX 引擎)拒绝处理其中包含 developer 角色的消息,导致接口返回 500 并中断流式响应。优先排查 Ollama 版本是否过旧,并确认是否能升级到最新版本。
适用环境:macOS Apple Silicon(含 M3 Max / macOS 15.x)、Ollama 0.32.12(旧版)、Codex CLI 0.147.0、模型为 qwen3.8:27b-mlx 或 qwen3.8:27b-mxfp8,MLX 引擎版本为 0.32.0-190-g3abd0fd。
最快修复方案:升级 Ollama 到最新版本。Issue 评论中有用户确认“升级到最新发布版后问题解决”。如果当前版本低于最新版,优先尝试升级。
注意事项:该修复证据来自 Issue 评论中的用户反馈,未在 Issue 中被维护者显式验证;尚不清楚具体哪个版本修复了该问题。若升级后仍失败,可能需要等待模型或 Codex CLI 的后续更新,或改用 ollama run 直接对话作为临时绕行方案。
问题场景
用户在 macOS Apple Silicon 环境下使用 qwen3.8:27b-mlx 模型,通过 ollama launch codex 启动 Codex CLI(版本 0.147.0)。当用户输入“List the files under Research only. Do not make changes.”这类指令后,Codex 无法收到模型响应,而是抛出 stream disconnected before completion 错误。Ollama 服务端在接收 /v1/responses 请求时返回 500 错误。
报错原文
Codex: stream disconnected before completion: unexpected message role "developer"
Ollama server log:
POST /v1/responses returns 500
chat prompt error: unexpected message role "developer"
原因分析
可能原因:qwen3.8:27b-mlx 模型(MLX 引擎版本 0.32.0-190-g3abd0fd)在 /v1/responses 端点下不支持或不接受 developer 角色的消息。Codex CLI 在构造请求时包含了该角色,而模型引擎在校验消息角色时直接拒绝处理。Issue 作者用 ollama run 直接对话可以正常工作,说明问题仅出现在走 /v1/responses 的集成链路中。另一个用户反馈显示,多个支持 Codex CLI 的模型(如 pi、hermes、claude code)也出现相同超时或失败,但本地对话一切正常,进一步把问题指向 /v1/responses 这个特定端点的兼容性,而非模型本身的能力。
环境排查
- 确认 Ollama 版本,Issue 中记录的是 0.32.12,建议检查是否有更新的稳定版。
- 确认模型完整名称与引擎标识:
qwen3.8:27b-mlx或qwen3.8:27b-mxfp8。 - 确认 macOS 版本与芯片类型(Issue 中提及 Apple Silicon,M3 Max 可复现)。
- 确认 Codex CLI 版本是否为 0.147.0,或尝试使用最新版本重试。
- 确认 MLX 引擎构建标识:0.32.0-190-g3abd0fd(在 Ollama 约 0.32.x 版本中内置)。
解决步骤
- 先做对照实验,确认模型本身可用:在终端执行
ollama run qwen3.8:27b-mlx "Reply with exactly: local model works",如果正常回复说明模型与本地运行链路无障碍。 - 升级 Ollama:下载并安装官方最新版(或通过应用内更新)。Issue 评论中有一条反馈“升级到最新发布版后正常工作”,可优先尝试此步骤。
- 若升级后问题依旧,检查 Ollama 服务日志中
POST /v1/responses的完整堆栈,确认是否仍提示unexpected message role "developer"。 - 如果仍然失败,尝试更换模型(如非 MLX 版本或其他 Qwen 权重格式),以判断是否为 MLX 引擎特有的角色支持问题。
- 暂时无法解决时,可改用 Codex CLI 的本地直连模式(不通过 Ollama 的
/v1/responses),但该方法在 Issue 中未提供具体配置,只作为规避思路。
验证方法
在 Codex CLI 中重新执行“List the files under Research only. Do not make changes.”指令,确认 Codex 能收到模型输出,且 Ollama 服务端日志中 POST /v1/responses 不再返回 500、不再出现 unexpected message role "developer" 错误。如果升级后命令恢复流畅,即视为问题解决。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


