Eval bug: CUDA crash on tensor copy

用户运行 llama-server 进行多卡(2× NVIDIA RTX 5070 Ti)推理,使用 -c 160000 (长上下文)和 -ctk q8_0 -ctv q8_0 (量化缓存),并在升级到 NVIDIA 驱动 590 和 CUDA 13.1 后触发。同时,运行 test-backend

用户运行 llama-server 进行多卡(2× NVIDIA RTX 5070 Ti)推理,使用 -c 160000 (长上下文)和 -ctk q8_0 -ctv q8_0 (量化缓存),并在升级到 NVIDIA 驱动 590 和 CUDA 13.1 后触发。同时,运行 test-backend
![[BUG]: HTTP MCP Server only shows in UI when "type" is incorrect.](https://www.chat-gpts.plus/wp-content/uploads/2026/07/5917-162b1c44-768x403.jpg)
用户在 AnythingLLM Desktop v1.15.0 (macOS Tahoe 26.5.1, Apple Silicon M4 Pro) 上配置 HTTP MCP Server(本地 localhost:8080 )。使用 type: "sse" 或 type: "streamable"

在运行 RAGFlow v0.26.3 版本,并启用 MCP 服务器( --enable-mcpserver --mcp-mode=host )时,任何 MCP 客户端(如 Claude Code)执行 tools/list 请求,都会导致服务器崩溃,报错 AttributeError: 'str'

用户在使用 RAGFlow v0.26.3(或同期的 nightly 版本)时启用了 MCP Server,通过 streamable-HTTP 协议(路径 /mcp )发送 tools/list 请求。MCP 客户端(如 Cursor)或直接通过 curl 调用时,返回了 JSON-RPC 错误响

一位独立开发者发布了一个名为 Backlog 的开源工具,让 AI 编码代理的工作记忆、任务队列和项目上下文全部存储在本地的一个 SQLite 文件中,而不是依赖 AI 聊天窗口的长上下文。这让多个 AI 代理能以更低成本并行工作,并且每次操作都带有签名可追溯。

在使用 Langfuse MCP 服务器(`cloud.langfuse.com/api/public/mcp`)通过 OpenAI Codex/GPT 或 Google Vertex/Gemini 调用函数时触发。具体表现为通过 MCP 暴露的 `updateScoreConfig` / `cre

用户在 Open WebUI v0.10.2(Docker 安装,Linux 系统)中,通过 Workspace 创建新模型时,期望在模型工具选择列表中看到之前在管理员控制台中以 MCP Server 方式创建的外部工具。v0.9.6 版本中该功能正常,升级到 v0.10.2 后外部工具不再显示。

Robinhood 在伦敦发布了一系列重大产品更新,包括在欧洲面向合规用户推出涵盖商品、ETF 和外汇的永续期货合约(支持最高 10 倍杠杆),同时发布了基于 Arbitrum 的 Layer-2 区块链 Robinhood Chain、全球可交易的代币化美股(Stock Tokens)以及面向美国用户的 A…

开发者 Kerlenton 发布了 Mcpsnoop,一个开源工具,能够作为透明代理截获并实时展示 AI 客户端(如 Claude Desktop、Cursor)与 MCP 服务器之间的完整 JSON-RPC 通信。它解决了官方 MCP Inspector 无法监听真实客户端流量、只能在服务器端设置断点的问题…

该功能提议适用于需要将 CrewAI 部署到受欧盟法规监管的行业中。在这些场景下,每个 Agent 角色需要: