bug: public scores API operator parameter odd behavior

用户在使用 Langfuse Cloud 的 Python SDK 调用 score_v2 API,通过 operator 和 value 参数过滤评分(例如 operator=">" 和 value=0 ),期望返回大于 0 的评分,但实际 API 返回了 0 条结果;而当使用 operator=

用户在使用 Langfuse Cloud 的 Python SDK 调用 score_v2 API,通过 operator 和 value 参数过滤评分(例如 operator=">" 和 value=0 ),期望返回大于 0 的评分,但实际 API 返回了 0 条结果;而当使用 operator=

用户使用 vLLM 在 Intel XPU(Arc GPU)的 Docker 容器中运行 vllm serve 命令时出现此错误。复现环境:基于 Intel oneAPI / PyTorch 2.12.0+xpu 的 Docker 自定义镜像,Level Zero 驱动可正常检测到 2 张 GPU(

用户在 Arch Linux(Cachy OS)上使用 AMD 7800XT GPU 运行 ComfyUI,每次打开软件首次生成图像时都卡在加载 checkpoint 步骤,且重启后问题重复。用户已正确安装 PyTorch ROCm 版本,创建 venv 并安装 requirements.txt。
![[Bug]: [ERROR][Exception]: Exceptions from Trio nursery](https://www.chat-gpts.plus/wp-content/uploads/2026/07/12545-a5895cec-768x403.jpg)
用户使用 RAGFlow v0.22.1,上传包含 10,382 个文件的知识库进行大规模解析,并点击生成知识图谱(Knowledge Graph)。在嵌入节点处理到约 1809/1894 步时,服务返回 500 错误,解析任务中断且无法通过界面按钮继续。

用户在 Ubuntu Linux(AMD GPU)系统上启动 ComfyUI 时触发。ComfyUI 在初始化过程中尝试导入 `comfy_aimdo.vram_buffer`,但该模块因缺少 NVIDIA CUDA 运行时库(`libcuda.so.1`)而无法加载,最终导致 ComfyUI 启动

用户在使用 llama-cli 或 llama-server 通过 -sm tensor 参数加载 Gemma 4 31B 模型(Unsloth Q5_K_XL 量化)时,模型加载成功,但发送少量请求(通常第一个请求成功,第二个请求崩溃)后出现 CUDA 错误并硬崩溃。该问题在单次 llama-cl
![[Bug]: GLM tool-call streaming final chunks repeat metadata and combine arguments with finish_reason](https://www.chat-gpts.plus/wp-content/uploads/2026/07/44098-762f8462-768x403.jpg)
用户在 vLLM main 分支(commit 6bdabbad5 / 023808c23 )上,通过 OpenAIServingChat 服务层,使用 GLM 工具解析器(如 glm45 / glm47 )进行工具调用的流式输出时触发。问题不依赖具体 GLM 模型权重加载,可通过 unit tes

用户在 Conda 虚拟环境中运行 peer-reviewed 研究源码,尝试从 transformers 导入 AutoModelWithLMHead 、 AutoTokenizer 和 EsmModel 。此时已安装 PyTorch 2.12.0 和 transformers 5.10.0.de

在 Dify 自托管(Source)环境中运行主分支代码,通过 ORM 操作触发相关的服务(如 api/services/trigger/* 、 schedule_service.py 、 webhook_service.py 等)进行更新后,发现 updated_at 字段长时间未变化,可能影响依

用户在 Open WebUI (v0.10.2) 中,为了支持解析 .msg 邮件文件(通过 OutlookMessageLoader),手动将 extract_msg 依赖添加到 requirements.txt ,随后执行构建时触发依赖冲突。