Ollama windows-amd64-mlx is denied MLX models from Ollama model catalog

该报错发生在 Windows 平台下使用非官方 MLX 版本 Ollama 拉取 MLX 模型时,模型目录服务端根据请求头中的操作系统信息拒绝了下载请求。优先排查当前 Ollama 版本是否包含 MLX 运行时支持,不建议在 Windows 上依赖 MLX 后端。

快速结论:该报错发生在 Windows 平台下使用非官方 MLX 版本 Ollama 拉取 MLX 模型时,模型目录服务端根据请求头中的操作系统信息拒绝了下载请求。优先排查当前 Ollama 版本是否包含 MLX 运行时支持,不建议在 Windows 上依赖 MLX 后端。

适用环境:Windows amd64 架构,使用 ollama-windows-amd64-mlx.zip 非正式发布包,Ollama 版本未知(Issue 中未提供),但讨论中确认 Ollama v0.32.10 已引入 MLX 运行时检测。

最快修复方案:暂无确认的一步修复方案。Issue 中提出设置 $env:OLLAMA_MLX_BACKENDS="cuda" 的方式被维护者否认,该变量并非服务器环境变量,而是构建时选项,因此不可作为有效解决方案。

注意事项:MLX 运行时为 Apple Silicon 设计,非 macOS 平台未获官方支持。若确实需要在 Windows 上运行量化模型,建议改用 NVFP4/Q4 等非 MLX 格式;另需注意社区用户反馈在 Linux 下使用 Ollama v0.32.10 可直接拉取 qwen3.5:9b-nvfp4 正常加载运行。

问题场景

用户在 Windows 系统中下载并解压了 ollama-windows-amd64-mlx.zipollama-windows-amd64.zip 两个压缩包并合并使用,尝试执行 ollama.exe pull qwen3.6:27b-mxfp8 拉取 MLX 格式模型时,命令返回错误,提示拉取模型清单失败,错误码为 412,信息为 this model requires macOS。用户的目录结构包含 ollama.exeREADME_MLX.txtvc_redist.x64.exelib 子目录。

报错原文

.\ollama.exe pull qwen3.6:27b-mxfp8
pulling manifest
Error: pull model manifest: 412: this model requires macOS

原因分析

可能原因:Ollama 模型目录服务端在响应拉取请求时,根据请求头携带的操作系统标识进行访问控制,而非依据本地 Ollama 引擎对 MLX 格式的实际支持情况。由于 Windows 请求头并非 macOS,服务端直接拒绝了模型清单的获取。另一个可能原因是:自 Ollama v0.32.10 起,Ollama 通过检测本机是否包含 MLX 运行时来决定是否允许拉取 MLX 格式模型,而当前 Windows 构建版本可能缺少对应的 MLX 运行时组件,客户端未能通过校验。此外,社区维护者明确指出 MLX 仅在 Apple Silicon 上设计运行,Windows 环境并非官方支持平台,因此模型的可用性与服务端策略均围绕 macOS 环境设计。

环境排查

  • 确认当前 Ollama 版本号(ollama.exe -v),对照是否为 v0.32.10 或更高版本。
  • 检查 ollama-windows-amd64-mlx.zip 的 SHA256 是否与发布值一致:8c8da4ebd663ed1ee8beb5508968ab2016308fbcf029e36af08f9dc88b95da4d,排除文件损坏可能。
  • 确认 ollama-windows-amd64.zip 的 SHA256 是否为 f248475a81a7dcd841a32e1f6c06c83310c893c49c4bdf7da8c10f3eef27231a,确保两个包版本匹配。
  • 检查本地是否存在 MLX 运行时库文件(位于 lib 目录内),确认 MLX 运行时是否随包正常部署。
  • 核实系统是否安装了 VC++ Redistributable(vc_redist.x64.exe),排除基础运行库缺失导致 Ollama 无法正常识别后端能力。

解决步骤

  1. 先在命令行执行 ollama.exe -v 确认 Ollama 的具体版本号,判断是否包含 MLX 运行时支持机制。
  2. 检查 lib 目录下列出的文件,确认是否包含 MLX 相关运行时(如 libmlx 等文件),若缺失则可能是两个 zip 包合并方式不正确。
  3. 尝试下载并直接拉取非 MLX 格式的同类模型,例如 qwen3.5:9b-nvfp4,如果该模型可正常拉取并运行,则确认问题仅影响 MLX 格式模型。
  4. 可优先尝试:将 ollama.exeollama-windows-amd64.zip 的完整文件合并覆盖到同一目录后,重新执行 pull 命令;该步骤旨在排除 MLX 专用构建与常规构建之间文件缺失或版本不一致的可能。
  5. 若确认当前环境无法拉取 MLX 模型,建议改用官方支持 Windows 的模型格式(如 Q4_K_M、NVFP4 等),避免使用 MLX 量化格式。
  6. 关注后续 Ollama 版本更新,等待官方对 Windows 平台 MLX 模型下载策略的正式支持或调整。

验证方法

重新执行 ollama.exe pull <模型名>,若不再返回 412 错误且出现 success 输出,则说明问题已解决。也可通过 ollama.exe list 查看已拉取模型列表,确认目标模型已存在本地缓存中。对于非 MLX 格式模型,可进一步执行 ollama.exe run <模型名> 验证模型能否正常加载并响应对话。

参考来源

ollama/ollama #16265

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 21234

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注