Not utilizing Intel QuickSync iGPU

这个报错通常发生在 Ollama 以 Docker 容器方式运行、同时接入了 Intel iGPU 的机器上——容器只看到 CPU,日志里明确写出 "Not utilizing Intel QuickSync iGPU",原因是集显被 Ollama 默认丢弃。优先排查是否设置了 OLLAMA_IGP

快速结论:这个报错通常发生在 Ollama 以 Docker 容器方式运行、同时接入了 Intel iGPU 的机器上——容器只看到 CPU,日志里明确写出 “Not utilizing Intel QuickSync iGPU”,原因是集显被 Ollama 默认丢弃。优先排查是否设置了 OLLAMA_IGPU_ENABLE

适用环境:Ollama(日志中版本为 0.34.2,以 Docker 镜像 ollama/ollama 运行)、OpenWebUI 作为前端、宿主机为 11th Gen Intel Core i5-1135G7(Intel Iris Xe Graphics / TGL GT2)、后端可用 Vulkan 与 CPU。Issue 未确认 CUDA、Python、PyTorch 版本。

最快修复方案:为 Ollama 容器设置环境变量 OLLAMA_IGPU_ENABLE=1,重新创建容器后让 Ollama 重新发现 GPU。

注意事项:该方案来自 Issue 日志中 Ollama 自身的提示(”dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1″),帖子未回帖确认最终生效。启用集显后推理是否比 CPU 更快、显存是否够用,取决于模型大小和可用显存,需要自行实测;容器已挂载 /dev/dri 只是前提条件,不等于集显会被启用。

问题场景

用户在 Docker 中运行 Ollama(compose.yaml 里挂载了 /dev/dri:/dev/dri,并通过 11434 端口对接 OpenWebUI)。提问可以正常得到回答,但宿主机上观察不到 Intel iGPU 的活动,也就是说推理实际上跑在 CPU 上,没有使用 Intel QuickSync 集显。

报错原文

msg="dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1" id=0 library=Vulkan compute=0.0 name=Vulkan0 description="Intel(R) Iris(R) Xe Graphics (TGL GT2)" pci_id=0000:00:02.0

msg="inference compute" id=cpu library=cpu compute="" name=cpu description=cpu libdirs=ollama driver="" pci_id="" type="" total="31.0 GiB" available="31.0 GiB"

原因分析

日志表明 Ollama 的 GPU 发现流程确实找到了集显(library=Vulkanname=Vulkan0Intel(R) Iris(R) Xe Graphics (TGL GT2)),但随后主动丢弃了它,理由是未启用集成 GPU 支持,对应环境变量 OLLAMA_IGPU_ENABLE 为空。丢弃之后,可用于推理的设备只剩 library=cpu,所以模型加载走 CPU 路径(日志中的 disabling mmap for llama-server load by default ... reason=cpu 也印证了这一点),宿主机自然看不到 iGPU 占用。

此外,日志显示 OLLAMA_VULKAN:true 已打开,说明 Vulkan 后端本身是可用的;因此问题更可能集中在集显开关未开启,而不是缺少驱动或设备节点。

环境排查

  • 确认 Ollama 版本与运行方式:Issue 中为 Docker 容器、日志版本 0.34.2。
  • 确认容器是否挂载了 iGPU 设备:compose 中已有 devices: - /dev/dri:/dev/dri
  • 确认 OLLAMA_IGPU_ENABLE 是否为空:日志 server config 的 env 映射里该值为空。
  • 确认 OLLAMA_VULKAN 状态:日志中为 true,即 Vulkan 已启用。
  • 核对 GPU 发现日志:出现 dropping integrated GPU 即代表检测到了集显但未启用。

解决步骤

  1. 在 Ollama 容器的环境变量中加入 OLLAMA_IGPU_ENABLE=1,让 Ollama 不再丢弃集显。
  2. 保留已有的 /dev/dri:/dev/dri 设备映射,不要移除。
  3. 用修改后的配置重建容器(重新 docker compose up 或等价的重新创建容器操作),使新的环境变量生效。
  4. 启动后查看 Ollama 日志中的 GPU 发现段,确认不再出现 dropping integrated GPU,且推理设备列表中出现 Vulkan 设备而非仅 library=cpu

验证方法

重新加载一个模型并发起一次推理,然后检查两处:一是 Ollama 启动日志里是否仍然出现 “dropping integrated GPU”(不应再出现),以及是否仍只把 library=cpu 列为推理设备;二是宿主机上是否能看到 Intel Iris Xe 的 GPU 占用上升。如果集显开始被使用,说明问题已解决;若仍显示 CPU 推理,则需回到日志继续核对 OLLAMA_IGPU_ENABLE 是否真正传入了容器。

参考来源

ollama/ollama #18548

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 24560

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注