快速结论:该问题通常出现在 Ubuntu Linux 上通过 systemd 配置 Ollama 服务监听 0.0.0.0:8200 后,发现端口以 IPv6(tcp6)形式监听,且客户端调用时提示需要先运行 ollama serve。优先排查客户端环境变量 OLLAMA_HOST 是否与服务端配置一致。
适用环境:Ubuntu 26.04、NVIDIA H200 GPU、CUDA 13.2、Ollama 0.32.14、systemd 服务管理。
最快修复方案:已在 Issue 讨论中被原提问者确认有效。除 systemd 服务端配置 Environment="OLLAMA_HOST=0.0.0.0:8200" 外,还需在客户端 Shell 中设置 export OLLAMA_HOST=:8200,再执行 ollama run muse-glimmer。
注意事项:上述客户端环境变量是 Issue 讨论中验证可行的方案,并未确认其在文档中的明确位置;端口以 tcp6 显示属于系统 IPv4-mapped IPv6 监听的常见现象,并非配置错误。
问题场景
用户在使用 Ollama 0.32.14 时,通过 systemd 服务将监听地址配置为 0.0.0.0:8200,但 netstat 显示服务监听在 tcp6 :::8200(IPv6)。当用户执行 ollama run muse-glimmer 时,Ollama 提示需要先运行 ollama serve,尽管服务已在后台运行。随后用户运行 ollama serve,又会启动一个默认监听 127.0.0.1:11434 的新实例。
报错原文
Change ollama config OLLAMA_HOST port for IP4 not IP6
ollama run muse-glimmer
ollama tells me I have to call `ollama serve` first
原因分析
可能原因:Ollama 客户端默认连接 127.0.0.1:11434。当 systemd 服务端修改为监听 0.0.0.0:8200 后,客户端仍使用默认配置寻找服务,因此找不到正在运行的服务,从而提示需要先执行 ollama serve。端口以 tcp6 形式显示是 Linux 下 IPv4 地址映射到 IPv6 监听的常见行为,并非实际只监听 IPv6。
环境排查
- 确认 Ubuntu 系统 systemd 服务文件中的
Environment="OLLAMA_HOST=0.0.0.0:8200"已正确写入并生效(sudo systemctl daemon-reload后重启服务)。 - 确认当前 Shell 会话中的
OLLAMA_HOST环境变量值,使用echo $OLLAMA_HOST检查。 - 确认是否有多个 Ollama 进程在运行(
pgrep -a ollama),端口 11434 是否被占用。
解决步骤
- 先确认 systemd 服务已正常启动并监听 8200 端口:
sudo systemctl start ollama后执行sudo netstat -tnlp | grep 8200。 - 在调用客户端的同一个终端会话中设置环境变量:
export OLLAMA_HOST=:8200。 - 再执行客户端命令:
ollama run muse-glimmer。 - 如果仍无法连接,可检查是否有多余的默认实例占用 11434 端口,先停止多余服务再重试。
验证方法
设置 OLLAMA_HOST=:8200 后,执行 ollama run muse-glimmer 能正常进入模型交互界面,不再提示需要先运行 ollama serve,即表示问题已解决。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。

![[Bug] Gmail trigger silently stops after 7 days: subscription expires_at is persisted as -1](https://www.chat-gpts.plus/wp-content/uploads/2026/09/41162-d3216684-768x403.jpg)
