glm-5.2:cloud May Have Suffered Significant Intelligence Degradation

用户通过 Oh My Pi (OMP) 工具,借助 Ollama 的 :cloud 代理调用云端模型 `glm-5.2` 进行编程(使用 hashline 编辑模式)时,发现模型编辑能力显著退化,具体表现为:误改代码、遗漏行、破坏文件结构等,且输出速度明显变快。用户怀疑是模型本身或量化方式(如 NV

glm-5.2:cloud May Have Suffered Significant Intelligence Degradation

glm-5.2:cloud May Have Suffered Significant Intelligence Degradation

快速结论:该报错描述了用户在使用 Ollama 本地代理调用 `glm-5.2:cloud` 模型时,模型输出质量(尤其是代码编辑能力)突然下降的问题。优先排查是否使用了正确的 `reasoning`(思考)配置,并确认客户端(如 Oh My Pi)是否已更新以获取最新的模型元数据(`contextWindow`、`maxTokens`)。

问题场景

用户通过 Oh My Pi (OMP) 工具,借助 Ollama 的 :cloud 代理调用云端模型 `glm-5.2` 进行编程(使用 hashline 编辑模式)时,发现模型编辑能力显著退化,具体表现为:误改代码、遗漏行、破坏文件结构等,且输出速度明显变快。用户怀疑是模型本身或量化方式(如 NVFP4)导致的问题。议题最终被用户关闭,但官方调查后确认了由模型退役(retirement)和配置缺失引起的几个问题。

报错原文

glm-5.2:cloud May Have Suffered Significant Intelligence Degradation

Before the 15th of this month (July) or so, the cloud-hosted glm-5.2 model was performing normally.
...
glm-5.2 started messing up my working directory.
...
glm failed to edit correctly or made erroneous edits roughly half the time (adding or deleting lines of code incorrectly—quite destructive).
...
I observed that the output speed of glm-5.2 on Ollama had noticeably increased. I remember being pleased at the time (because it was truly lightning fast). I don't know if the two are related, but this editing issue is fatal.

原因分析

根据官方调查结果,可能原因包括:

  • 模型版本退役与元数据缺失: 2026年7月15日前后,Ollama 云服务将 `glm-5` 和 `glm-4.7` 退役,转而使用 `glm-5.2`。此更新遗漏了 `/api/show` 端点中的 `glm-5.2` 模型限制(`contextWindow`、`maxTokens`),导致客户端(如 OMP)收到 `contextWindow=0` 或未设置 `maxTokens`,从而影响模型行为。
  • 客户端 reasoning 标志缺失: Oh My Pi 未正确设置 `reasoning: true` 标志。对于默认以非推理模式运行的模型,客户端若不主动启用,可能导致模型输出质量下降,尤其影响需要长链思考的代码编辑任务。
  • 客户端配置未更新: OMP 本地缓存的模型配置文件(`~/.omp/agent/models.yml`)可能仍包含旧模型引用(如 `glm-5.1:cloud`),未同步最新的 `glm-5.2:cloud` 配置。

环境排查

  • Ollama 版本: 请确认是否已更新至最新版,以确保 `model limits` 和推荐列表同步。
  • Oh My Pi (OMP) 版本: 确认是否已更新至支持 `reasoning` 标志的版本,可通过 ollama launch omp 更新本地配置。
  • 客户端配置文件: 检查 ~/.omp/agent/models.yml 中 `glm-5.2:cloud` 条目是否包含 `reasoning: true`、`contextWindow` 和 `maxTokens`。
  • 上游 API 直接对比: 对比 `glm-5.2:cloud` 在本地 Ollama 代理、Oh My Pi、以及直接调用 ollama.com API(设置 `”think”: true`)时的输出质量。

解决步骤

  1. 确认模型代理无转换问题:
    • 直接调用 ollama run glm-5.2:cloud 并手动启用 `thinking`(如果客户端支持),与直接调用 ollama.com API(设置 "think": true)比较同一编辑提示的输出。
    • 如两者表现一致,问题可能在于上游模型行为;如 Oh My Pi 表现更差,则问题在客户端配置。
  2. 更新 Oh My Pi 配置:
    • 运行 ollama launch omp 命令刷新本地配置。该操作会更新 ~/.omp/agent/models.yml,以确保包含正确的 `reasoning: true`、`contextWindow`(1,048,576)和 `maxTokens`(131,072)设定。
  3. 验证客户端 reasoning 标志:
    • 确认 Oh My Pi 的请求中包含了 `”reasoning”: true` 或等效参数。如果缺失,需手动启用或等待 OMP 更新。
  4. 检查上游 API 行为:
    • 如果所有路径(本地代理、OMP、直接 API)均出现退化,则推测为上游模型自身回归或退役后的行为变化,而非 Ollama 代理问题。用户可提供编辑提示、思考长度和可复现的最小测试用例给上游。

验证方法

  • 运行 ollama run glm-5.2:cloud 并执行一个之前会失败的编辑任务(如文件修改)。
  • 检查 Oh My Pi 的日志或输出,确认请求中包含了 `”reasoning”: true`。
  • 重新检查 ~/.omp/agent/models.yml 中 `glm-5.2:cloud` 条目的参数是否正确。

参考来源

ollama/ollama #17265

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

celebrityanime
celebrityanime
文章: 15087

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注