快速结论:当你在 Ollama 中调用 deepseek-v4.1-flash:cloud 并附带图片时,模型虽然声明支持 vision,但会静默丢弃所有图像输入且不报错,最终回答表现得像从未收到图片。遇到此问题时优先确认是否为该模型特有的服务端行为,而非客户端或网络节点故障。
适用环境:Ollama 客户端 0.32.0 与 0.34.2;直连 https://ollama.com 并携带 bearer token;涉及 API 端点 /api/chat、/api/generate、/v1/chat/completions、/v1/messages;操作系统、Python、CUDA 及显卡信息在 Issue 中未明确提及。
最快修复方案:暂无确认的一步修复方案。Issue 中未提供已验证的修复操作,问题需等待上游(服务端模型渲染或客户端路由)修复。
注意事项:不要尝试通过更换客户端版本、重拉模型或切换网络节点来解决,原报告已验证这些变量均不影响结果;同时不要假设其他 vision 模型会同样失败,同账号下其他模型可正常读取图片或返回明确错误。
问题场景
用户在 Ollama 中调用云端模型 deepseek-v4.1-flash:cloud,通过命令行或 API 发送带有图片的多模态请求时触发。用户已尝试直接使用 curl 调用 https://ollama.com 并携带 bearer token,绕过本地客户端框架和拉取代理,问题依然存在。同一账号下的其他 vision 模型(如 qwen3.5:397b、minimax-m3、kimi-k2.6 等)均可正常读取图片或返回明确错误。
报错原文
[Cloud] deepseek-v4.1-flash silently discards all image input while advertising `vision` in capabilities
模型自身在推理轨迹中输出 no image provided,并以芬兰语回复:En näe tässä kuvaa(意为“我没有看到图片”)。
原因分析
根据 Issue 中的测量数据,最可能的原因是服务端在处理该模型时,将图像替换为一个固定标记而非真正进行 tokenization。决定性证据是 prompt_eval_count 的增量不随图像尺寸变化:20×16 px 与 2500×2000 px 的图片均只增加约 2 个 token,而对照组 qwen3.5:397b 的增量随图像尺寸显著增长(+74 到 +2522)。该行为在连续 8 次相同请求中完全确定(均为 41、41、41、41、41、41、41、41),且跨三个大洲的不同出口节点及直连云端均复现一致,因此可排除客户端框架、本地代理、网络路径、图片格式、API 端点、消息角色和模型标签等因素。
由于原始 Issue 未提供官方修复记录或根因确认,此处仅判断为服务端模型渲染或路由层面的异常,具体归属(客户端或服务端)尚未被上游证实。
环境排查
- 确认 Ollama 客户端版本:Issue 中涉及 0.32.0 和 0.34.2,两个版本表现一致。
- 确认是否直连
https://ollama.com并携带 bearer token,以排除本地 pull-through 代理影响。 - 确认同一账号下其他 vision 模型(如
qwen3.5:397b、kimi-k2.6)是否能正常读取同一张图片。 - 确认发送的图片格式(PNG、JPEG、data URL、raw base64)及 API 端点(
/api/chat、/api/generate、/v1/chat/completions、/v1/messages)是否影响结果。 - 确认网络出口节点及托管商是否影响结果。
- Python、CUDA、PyTorch、显卡型号等信息在 Issue 中未明确,无需作为排查项。
解决步骤
- 在相同 daemon、相同节点、相同时刻下,同时向
deepseek-v4.1-flash:cloud和一个已知可正常读取图片的模型(如qwen3.5:397b)发送同一张图片,比较两者的prompt_eval_count增量。若deepseek-v4.1-flash的增量固定为约 +2 且不随图片尺寸变化,而对照模型增量随尺寸增长,则可确认问题模型特有。 - 使用不同尺寸的图片(例如 20×16 px、200×160 px、1000×800 px、2500×2000 px)分别请求
deepseek-v4.1-flash:cloud,观察prompt_eval_count是否始终为固定值。若固定不变,说明图像未被 tokenization。 - 检查模型返回内容中是否包含
no image provided或类似否定视觉输入的表述,作为辅助确认。 - 在确认问题后,避免依赖该模型进行任何图像理解任务,改用同账号下已验证可读取图片的模型作为替代。
- 若需推动修复,可向 Ollama 仓库提交补充信息或关注 Issue #18527 的后续更新,但 Issue 中未提供可自行执行的修复命令或配置变更。
验证方法
发送一张已知可被其他模型正确识别的图片给 deepseek-v4.1-flash:cloud,若模型仍回答无法看到图片且 prompt_eval_count 的增量不随图片尺寸变化(始终约为 +2),则问题未解决。若模型能正确描述图片内容,或 prompt_eval_count 增量随图片尺寸显著增长,则问题已修复。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


