快速结论:当在 Ollama 的 chat 输入里让模型翻译一份目录(Table of Contents / List of Figures),且标题与页码之间存在超过十个连续省略点(ellipses,即“….”)时,输出会在中途断开,server 日志出现 stop: cancel task。优先排查触发文本的省略点数量,而不是先怀疑显卡或模型加载。
适用环境:Issue 已确认:Ollama 0.33.3 与 0.34.0;Windows;CPU 为 Intel;GPU 为 Nvidia(日志中为 GTX 1060 6GB,CUDA compute 6.1,但该卡被判定 “compute capability not in compiled architectures” 而跳过);模型 ornith:9b;上下文相关设置见日志 OLLAMA_CONTEXT_LENGTH:65536。
最快修复方案:暂无确认的一步修复方案。Issue 讨论中只复现了问题并给出 server 日志,未给出被维护者确认的修复补丁或参数调整。
注意事项:复现依赖特定文本结构(超过十个连续省略点),并非所有目录都会触发;换模型或调上下文是否有效尚未在该 Issue 中验证,只能作为可优先尝试的排查方向。
问题场景
用户在 Ollama chat 消息输入框中,粘贴一段带目录/图表清单的英文文本,并要求 “translate below text to chinese”。文本形如 1.3.1 AMS GRA Supported Tenets . . . . . . . . . . . 5,标题与页码之间由大量连续省略点填充。模型开始输出译文后不久中断,只输出到标题部分,页码与后续条目丢失。查看 server.log 可见 stop: cancel task。
报错原文
stop: cancel task
相关日志上下文还包括:
level=INFO source=llama_server.go:295 msg="skipping CUDA device — compute capability not in compiled architectures" device="NVIDIA GeForce GTX 1060 6GB" cc=610 archs="[750 800 860 890 1000 1200]"
level=INFO source=runner.go:405 msg="dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1"
level=INFO source=routes.go:2072 msg="vram-based default context" total_vram="6.0 GiB" default_num_ctx=4096
原因分析
从 Issue 证据看,触发条件是输入文本中“标题与页码之间存在超过十个连续省略点”。这种长串连续点号可能被模型/tokenizer 处理成异常输出模式,导致生成过程中任务被取消,日志表现为 stop: cancel task。
需要注意,Issue 中的 GPU 日志显示 GTX 1060(compute 6.1)被跳过、未进入 CUDA 编译架构列表,且实际用的是 cuda_v12;这属于并存的运行环境现象,讨论中并未证明它是 cancel task 的直接原因,因此只能作为可能相关的背景因素,而非确认结论。
环境排查
- 确认 Ollama 版本:Issue 中出现的版本为 0.33.3 和 0.34.0。
- 确认操作系统:Windows。
- 确认 GPU 与驱动:Nvidia,日志显示 GTX 1060 6GB、driver 13.0、compute 6.1,并被提示 “compute capability not in compiled architectures”。
- 确认 CPU:Intel(日志中可见 Intel UHD Graphics 630 集成显卡被丢弃)。
- 确认模型:
ornith:9b。 - 确认相关环境变量:日志中
OLLAMA_CONTEXT_LENGTH:65536、OLLAMA_NUM_PARALLEL:1、OLLAMA_VULKAN:true、OLLAMA_NO_CLOUD:true。 - 确认输入文本中省略点的实际数量:是否确实存在超过十个连续点号。
解决步骤
- 先定位触发文本:检查待翻译的目录或图表清单,找出标题与页码之间连续省略点超过十个的条目。
- 改写输入,降低省略点密度:把连续点号替换为更少的点(例如少于十个),或改用单个分隔符、Tab、制表位、固定短横线,再重新提交翻译。
- 对比复现:用改写后的文本再跑一次,观察输出是否完整、
server.log中是否还出现stop: cancel task。 - 如问题仍存在,用 Ollama 官方 troubleshooting 文档提到的方式收集并查看 server 日志,作为进一步定位依据。
- 可优先尝试:更换模型或调整上下文相关设置后再试(该方向仅为可优先尝试,Issue 中未验证其有效性)。
- 如确认是省略点触发的稳定复现,可在 Issue 中附带最小输入样本与完整 server 日志,便于维护者定位。
验证方法
用改写后省略点较少的同一段目录文本重新翻译,若译文能完整输出到页码及后续所有条目,且 server.log 中不再出现 stop: cancel task,即说明触发条件被规避。反向再用原始长省略点文本复测一次,若可稳定复现中断,则可确认该文本结构是诱因。
参考来源
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
这个方案解决了吗?
可以继续搜索完整报错,或查看同一工具的其他排查指南。


