快速结论:该报错发生在 Windows 平台下使用非官方 MLX 版本 Ollama 拉取 MLX 模型时,模型目录服务端根据请求头中的操作系统信息拒绝了下载请求。优先排查当前 Ollama 版本是否包含 MLX 运行时支持,不建议在 Windows 上依赖 MLX 后端。
适用环境:Windows amd64 架构,使用 ollama-windows-amd64-mlx.zip 非正式发布包,Ollama 版本未知(Issue 中未提供),但讨论中确认 Ollama v0.32.10 已引入 MLX 运行时检测。
最快修复方案:暂无确认的一步修复方案。Issue 中提出设置 $env:OLLAMA_MLX_BACKENDS="cuda" 的方式被维护者否认,该变量并非服务器环境变量,而是构建时选项,因此不可作为有效解决方案。
注意事项:MLX 运行时为 Apple Silicon 设计,非 macOS 平台未获官方支持。若确实需要在 Windows 上运行量化模型,建议改用 NVFP4/Q4 等非 MLX 格式;另需注意社区用户反馈在 Linux 下使用 Ollama v0.32.10 可直接拉取 qwen3.5:9b-nvfp4 正常加载运行。
问题场景
用户在 Windows 系统中下载并解压了 ollama-windows-amd64-mlx.zip 与 ollama-windows-amd64.zip 两个压缩包并合并使用,尝试执行 ollama.exe pull qwen3.6:27b-mxfp8 拉取 MLX 格式模型时,命令返回错误,提示拉取模型清单失败,错误码为 412,信息为 this model requires macOS。用户的目录结构包含 ollama.exe、README_MLX.txt、vc_redist.x64.exe 及 lib 子目录。
报错原文
.\ollama.exe pull qwen3.6:27b-mxfp8
pulling manifest
Error: pull model manifest: 412: this model requires macOS
原因分析
可能原因:Ollama 模型目录服务端在响应拉取请求时,根据请求头携带的操作系统标识进行访问控制,而非依据本地 Ollama 引擎对 MLX 格式的实际支持情况。由于 Windows 请求头并非 macOS,服务端直接拒绝了模型清单的获取。另一个可能原因是:自 Ollama v0.32.10 起,Ollama 通过检测本机是否包含 MLX 运行时来决定是否允许拉取 MLX 格式模型,而当前 Windows 构建版本可能缺少对应的 MLX 运行时组件,客户端未能通过校验。此外,社区维护者明确指出 MLX 仅在 Apple Silicon 上设计运行,Windows 环境并非官方支持平台,因此模型的可用性与服务端策略均围绕 macOS 环境设计。
环境排查
- 确认当前 Ollama 版本号(
ollama.exe -v),对照是否为 v0.32.10 或更高版本。 - 检查
ollama-windows-amd64-mlx.zip的 SHA256 是否与发布值一致:8c8da4ebd663ed1ee8beb5508968ab2016308fbcf029e36af08f9dc88b95da4d,排除文件损坏可能。 - 确认
ollama-windows-amd64.zip的 SHA256 是否为f248475a81a7dcd841a32e1f6c06c83310c893c49c4bdf7da8c10f3eef27231a,确保两个包版本匹配。 - 检查本地是否存在 MLX 运行时库文件(位于
lib目录内),确认 MLX 运行时是否随包正常部署。 - 核实系统是否安装了 VC++ Redistributable(
vc_redist.x64.exe),排除基础运行库缺失导致 Ollama 无法正常识别后端能力。
解决步骤
- 先在命令行执行
ollama.exe -v确认 Ollama 的具体版本号,判断是否包含 MLX 运行时支持机制。 - 检查
lib目录下列出的文件,确认是否包含 MLX 相关运行时(如libmlx等文件),若缺失则可能是两个 zip 包合并方式不正确。 - 尝试下载并直接拉取非 MLX 格式的同类模型,例如
qwen3.5:9b-nvfp4,如果该模型可正常拉取并运行,则确认问题仅影响 MLX 格式模型。 - 可优先尝试:将
ollama.exe与ollama-windows-amd64.zip的完整文件合并覆盖到同一目录后,重新执行 pull 命令;该步骤旨在排除 MLX 专用构建与常规构建之间文件缺失或版本不一致的可能。 - 若确认当前环境无法拉取 MLX 模型,建议改用官方支持 Windows 的模型格式(如 Q4_K_M、NVFP4 等),避免使用 MLX 量化格式。
- 关注后续 Ollama 版本更新,等待官方对 Windows 平台 MLX 模型下载策略的正式支持或调整。
验证方法
重新执行 ollama.exe pull <模型名>,若不再返回 412 错误且出现 success 输出,则说明问题已解决。也可通过 ollama.exe list 查看已拉取模型列表,确认目标模型已存在本地缓存中。对于非 MLX 格式模型,可进一步执行 ollama.exe run <模型名> 验证模型能否正常加载并响应对话。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。
![[bug]: InvokeAI v6.14.0-RC1 Crashed while generating Krea-2 Image](https://www.chat-gpts.plus/wp-content/uploads/2026/09/9444-d6bdc60c-768x403.jpg)
![[Question]: Shared embedded chat URL fails to access documents after logout or when accessed by other users](https://www.chat-gpts.plus/wp-content/uploads/2026/09/15895-cf3f7033-768x403.jpg)
