Unreliable free memory resulting in models not running

运行 Ollama 加载模型(特别是 CPU-only 推理场景),模型可能有时能加载、有时被拒绝,尤其在内存接近临界值、系统有其他程序占用内存时更容易触发。用户反馈在 Linux、Windows ARM、macOS 上均会出现。

运行 Ollama 加载模型(特别是 CPU-only 推理场景),模型可能有时能加载、有时被拒绝,尤其在内存接近临界值、系统有其他程序占用内存时更容易触发。用户反馈在 Linux、Windows ARM、macOS 上均会出现。

用户在 macOS 上使用 Ollama 0.13.3 尝试导入一个基于 mistral-small-3.2 的微调模型(从 HuggingFace 下载的 Safetensors 权重),执行 ollama create 命令时触发报错。同样的错误在使用官方版本 mistralai/Mistral

用户在 Windows 系统下首次打开 ComfyUI(通过 Comfy Desktop 启动),启动过程中 ComfyUI 自动下载 "image_z_image_turbo" 模板所需的模型文件(约19GB),下载完成后启动失败,抛出模块导入错误。

用户在 Langfuse Cloud 中通过 OpenTelemetry 上传 Trace 数据后,观察 Trace 列表页与 Observation 列表页,发现 input/output 字段显示为空,但进入具体的 trace 详情视图后,input 和 output 内容正常可见。

用户运行自托管的 Langfuse(版本 v3.167.4 OSS),在追踪中为不同用户生成了带有输入/输出 Token 的数据,随后在 UI 的“每位用户成本”视图中看到成本显示为 $0,但浏览器开发者工具和 curl 确认 API 响应中的成本值为非零。

用户在使用 Langfuse Cloud 的 Python SDK 调用 score_v2 API,通过 operator 和 value 参数过滤评分(例如 operator=">" 和 value=0 ),期望返回大于 0 的评分,但实际 API 返回了 0 条结果;而当使用 operator=
![[Bug]: GraphRAG relationship extraction writes negative-judgment and misattributed edges into the graph (light + general modes)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/16540-325d7f99-768x403.jpg)
该问题发生在使用 RAGFlow 的 GraphRAG 构建知识图谱时,特别是 light 模式(默认),也影响 general 模式。用户使用 qwen2.5:7b-instruct 模型通过 Ollama 进行关系抽取,并使用 Elasticsearch 8.11.3 作为文档存储。当文档集中包

用户在网页中通过 Web Component 嵌入 Hugging Face Space 应用时(例如使用 src="https://.hf.space" 或 space="/" ),控制台出现 400 或 CO

用户在 Linux 系统上运行 llama.cpp( llama-cli 或 llama-server ),使用 -hf ggml-org/gemma-3-1b-it-GGUF:Q4_K_M 等命令下载或加载模型时触发。问题重现于 Vulkan、ROCm 和 CPU 后端,涉及 AMD Radeon

用户在使用 llama-bench 工具测试 Qwen3-8B-Q4_K_M.gguf 模型时触发问题,硬件为 MINISFORUM MS-R1(CIX CP8180 SoC),配备 Mali-G720-Immortalis GPU 和共享内存池(UMA)。即使用 -ngl 0 参数禁止层卸载到 G