More than ten ellipses between Titles and Page Numbers in Table of Contents will cause ollama ‘cancel task’

当在 Ollama 的 chat 输入里让模型翻译一份目录(Table of Contents / List of Figures),且标题与页码之间存在超过十个连续省略点(ellipses,即“....”)时,输出会在中途断开,server 日志出现 stop: cancel task 。优先排查

快速结论:当在 Ollama 的 chat 输入里让模型翻译一份目录(Table of Contents / List of Figures),且标题与页码之间存在超过十个连续省略点(ellipses,即“….”)时,输出会在中途断开,server 日志出现 stop: cancel task。优先排查触发文本的省略点数量,而不是先怀疑显卡或模型加载。

适用环境:Issue 已确认:Ollama 0.33.3 与 0.34.0;Windows;CPU 为 Intel;GPU 为 Nvidia(日志中为 GTX 1060 6GB,CUDA compute 6.1,但该卡被判定 “compute capability not in compiled architectures” 而跳过);模型 ornith:9b;上下文相关设置见日志 OLLAMA_CONTEXT_LENGTH:65536。

最快修复方案:暂无确认的一步修复方案。Issue 讨论中只复现了问题并给出 server 日志,未给出被维护者确认的修复补丁或参数调整。

注意事项:复现依赖特定文本结构(超过十个连续省略点),并非所有目录都会触发;换模型或调上下文是否有效尚未在该 Issue 中验证,只能作为可优先尝试的排查方向。

问题场景

用户在 Ollama chat 消息输入框中,粘贴一段带目录/图表清单的英文文本,并要求 “translate below text to chinese”。文本形如 1.3.1 AMS GRA Supported Tenets . . . . . . . . . . . 5,标题与页码之间由大量连续省略点填充。模型开始输出译文后不久中断,只输出到标题部分,页码与后续条目丢失。查看 server.log 可见 stop: cancel task。

报错原文

stop: cancel task

相关日志上下文还包括:

level=INFO source=llama_server.go:295 msg="skipping CUDA device — compute capability not in compiled architectures" device="NVIDIA GeForce GTX 1060 6GB" cc=610 archs="[750 800 860 890 1000 1200]"
level=INFO source=runner.go:405 msg="dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1"
level=INFO source=routes.go:2072 msg="vram-based default context" total_vram="6.0 GiB" default_num_ctx=4096

原因分析

从 Issue 证据看,触发条件是输入文本中“标题与页码之间存在超过十个连续省略点”。这种长串连续点号可能被模型/tokenizer 处理成异常输出模式,导致生成过程中任务被取消,日志表现为 stop: cancel task。

需要注意,Issue 中的 GPU 日志显示 GTX 1060(compute 6.1)被跳过、未进入 CUDA 编译架构列表,且实际用的是 cuda_v12;这属于并存的运行环境现象,讨论中并未证明它是 cancel task 的直接原因,因此只能作为可能相关的背景因素,而非确认结论。

环境排查

  • 确认 Ollama 版本:Issue 中出现的版本为 0.33.3 和 0.34.0。
  • 确认操作系统:Windows。
  • 确认 GPU 与驱动:Nvidia,日志显示 GTX 1060 6GB、driver 13.0、compute 6.1,并被提示 “compute capability not in compiled architectures”。
  • 确认 CPU:Intel(日志中可见 Intel UHD Graphics 630 集成显卡被丢弃)。
  • 确认模型:ornith:9b。
  • 确认相关环境变量:日志中 OLLAMA_CONTEXT_LENGTH:65536、OLLAMA_NUM_PARALLEL:1、OLLAMA_VULKAN:true、OLLAMA_NO_CLOUD:true。
  • 确认输入文本中省略点的实际数量:是否确实存在超过十个连续点号。

解决步骤

  1. 先定位触发文本:检查待翻译的目录或图表清单,找出标题与页码之间连续省略点超过十个的条目。
  2. 改写输入,降低省略点密度:把连续点号替换为更少的点(例如少于十个),或改用单个分隔符、Tab、制表位、固定短横线,再重新提交翻译。
  3. 对比复现:用改写后的文本再跑一次,观察输出是否完整、server.log 中是否还出现 stop: cancel task。
  4. 如问题仍存在,用 Ollama 官方 troubleshooting 文档提到的方式收集并查看 server 日志,作为进一步定位依据。
  5. 可优先尝试:更换模型或调整上下文相关设置后再试(该方向仅为可优先尝试,Issue 中未验证其有效性)。
  6. 如确认是省略点触发的稳定复现,可在 Issue 中附带最小输入样本与完整 server 日志,便于维护者定位。

验证方法

用改写后省略点较少的同一段目录文本重新翻译,若译文能完整输出到页码及后续所有条目,且 server.log 中不再出现 stop: cancel task,即说明触发条件被规避。反向再用原始长省略点文本复测一次,若可稳定复现中断,则可确认该文本结构是诱因。

参考来源

ollama/ollama #18387

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

这个方案解决了吗?

celebrityanime
celebrityanime
文章: 25887

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注