issue: User Model Access for removed models persists

用户使用 Docker 安装的 Open WebUI 10.0.2 版本,运行在 Ubuntu 上。最初连接了 Ollama 提供商的 4 个模型并设置了某些用户的模型访问权限,之后切换到 llama.cpp 后端的模型,并删除了 Ollama 提供商。虽然 Ollama 模型已从模型列表中消失,但

用户使用 Docker 安装的 Open WebUI 10.0.2 版本,运行在 Ubuntu 上。最初连接了 Ollama 提供商的 4 个模型并设置了某些用户的模型访问权限,之后切换到 llama.cpp 后端的模型,并删除了 Ollama 提供商。虽然 Ollama 模型已从模型列表中消失,但

用户在 Open WebUI 0.10.2 版本中,使用 Docker 部署,搭配 Ollama 0.31.1 运行模型(例如 Qwen3.5 4B),并设置了自定义标题生成提示词。在开始新聊天时,系统会同时发送两个并发请求:一个用于标题生成,另一个用于助理响应。标题生成请求在助理响应之前触发,导致

用户在 HuggingFace Transformers 库的 generate() 调用中,使用 cache_implementation="static" 静态缓存路径,并希望通过 cache_config={"max_cache_len": N} 控制缓存的最大长度。但实际观察发现, cach

用户在 Hugging Face Transformers 中使用 generate() 进行文本生成,启用了 torch.compile 和 chunked prefill(通过设置 generation_config.prefill_chunk_size ),并使用静态缓存(Static Cac

用户在 Arch Linux(Cachy OS)上使用 AMD 7800XT GPU 运行 ComfyUI,每次打开软件首次生成图像时都卡在加载 checkpoint 步骤,且重启后问题重复。用户已正确安装 PyTorch ROCm 版本,创建 venv 并安装 requirements.txt。
![[Bug]: [ERROR][Exception]: Exceptions from Trio nursery](https://www.chat-gpts.plus/wp-content/uploads/2026/07/12545-a5895cec-768x403.jpg)
用户使用 RAGFlow v0.22.1,上传包含 10,382 个文件的知识库进行大规模解析,并点击生成知识图谱(Knowledge Graph)。在嵌入节点处理到约 1809/1894 步时,服务返回 500 错误,解析任务中断且无法通过界面按钮继续。

用户在 Ubuntu Linux(AMD GPU)系统上启动 ComfyUI 时触发。ComfyUI 在初始化过程中尝试导入 `comfy_aimdo.vram_buffer`,但该模块因缺少 NVIDIA CUDA 运行时库(`libcuda.so.1`)而无法加载,最终导致 ComfyUI 启动

用户在 llama.cpp 最新 master 分支(commit 418dea39cea85d3496c8b04a118c3b17f3940ad8 )下,使用 4 块 CUDA 设备 (通过 PCI-E 3.0 x1 连接)加载 Qwen3.5 27B / Qwen3.5-397B-A17B 等

用户在使用 llama-cli 或 llama-server 通过 -sm tensor 参数加载 Gemma 4 31B 模型(Unsloth Q5_K_XL 量化)时,模型加载成功,但发送少量请求(通常第一个请求成功,第二个请求崩溃)后出现 CUDA 错误并硬崩溃。该问题在单次 llama-cl

用户在 llama.cpp(b9672 版本)中,使用 `llama-completion` 或 `llama-cli` 工具,通过 `--sm tensor` 启用张量并行,指定 `--device ROCm1,ROCm3`(AMD GPU),配合 `-ncmoe 58` 参数加载 Qwen 3.