Image editing with Flux2 Klein models has not worked since around 0.15.6

使用 Ollama 运行 Flux2 Klein 系列模型(如 4B/9B)进行图像编辑时,自 0.15.6 版本起,模型会忽略输入图片并生成一张全新图片,而不是基于原图进行修改。优先排查当前 Ollama 版本,并尝试回退到已验证可用的旧版本。

快速结论:使用 Ollama 运行 Flux2 Klein 系列模型(如 4B/9B)进行图像编辑时,自 0.15.6 版本起,模型会忽略输入图片并生成一张全新图片,而不是基于原图进行修改。优先排查当前 Ollama 版本,并尝试回退到已验证可用的旧版本。

适用环境:Ollama 0.15.4 至 0.30.8(含)之间多个版本受影响;macOS Sequoia 15.7.3 / Tahoe 26.3.1 / 26.5;Apple M3 / Mac mini 2024;模型 x/flux2-klein:4b 与 9B 变体。

最快修复方案:暂无确认的一步修复方案。Issue 中提到 Ollama 0.23.0 仍可正常工作,0.15.4 为最后一个确认可用的版本,可优先尝试将 Ollama 回退到 0.15.4 或 0.23.0 进行验证。

注意事项:上述版本号来自 Issue 中不同用户的独立测试结果,并非官方确认的边界版本;图像编辑功能在此类模型中属于实验性支持,未来版本可能通过重新实现或移除该功能来解决,而非简单修复回归。

问题场景

用户通过 Ollama 的 API 或 CLI 调用 Flux2 Klein 4B/9B 模型,传入一张本地图片(如 .jpg 的人脸表情、风景图等),并附上编辑提示词(如“Make the face frown”或“Remove the bridge”)。在 Ollama 0.15.6 及之后的版本中,即使模型返回了“已添加图片”的响应,最终输出图片也完全不包含原图内容,相当于重新生成了一张无关图片。

报错原文

Image editing with Flux2 Klein models has not worked since around 0.15.6

该问题不产生显式错误日志,模型会正常完成推理流程,但输出图片与输入图片无关。

原因分析

可能原因:Ollama 在 0.15.6 版本中改动了对多模态输入(尤其是图像编辑场景)的处理逻辑,导致 Flux2 Klein 模型的图像条件输入(image conditioning)没有被正确传递到生成器,模型因此回退到纯文生图行为。该问题与模型版本无关,因为同一模型在旧版 Ollama 上工作正常;也可能与 Apple 芯片上的图像预处理或张量拼接方式有关,但 Issue 中未提供底层技术细节。

环境排查

  • 确认 Ollama 版本:在终端执行 ollama --version 查看当前版本号(与 0.15.4 对比)。
  • 确认模型标识:检查使用的模型是否为 x/flux2-klein:4bx/flux2-klein:9b,其他变体未在 Issue 中验证。
  • 确认输入图片格式:JPG/PNG 均可,问题与图片格式无关。
  • 如果使用 API,检查请求体中的 images 字段是否为 base64 字符串数组格式。

解决步骤

  1. 记录当前版本:运行 ollama --version 保存当前版本号备用。
  2. 回退 Ollama 版本:卸载当前 Ollama,然后安装 0.15.4 版本(Issue 中明确验证可用的最后一个版本)。macOS 用户可从官方 GitHub Releases 页面下载对应 .zip 包替换 /Applications 中的文件。
  3. 验证模型命令:使用类似 ollama run x/flux2-klein 的交互式命令,传入图片路径和编辑提示词(如 ./input.png turn this into anime style),观察输出图片是否保留原图特征。
  4. 若回退不可行:可优先尝试安装在 Issue 评论中被确认正常的 0.23.0 版本,该版本可能包含部分修复但未完全验证后续版本。
  5. 检查上游更新:留意 Ollama 官方 release notes 中关于“imagegen”或“vision”相关的变更,该功能可能被标记为实验性并可能在未来版本重构。

验证方法

使用同一张输入图片和同一编辑指令,分别在旧版本(0.15.4)和当前版本下运行,对比输出图片。若旧版本输出保留了原图结构(例如人脸轮廓、桥梁位置),而新版本输出完全不同的新图,则确认问题复现;修复成功的标志是回退后输出图与输入图存在可辨识的关联。

参考来源

ollama/ollama #14306

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 20228

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注