Eval bug: GGML_ASSERT(addr) failed when using MTP + Vulkan + –no-mmap on qwen 3.6 27b q8

用户在 Windows 系统上使用 llama-cli 或 llama-server(版本 9484,基于 Clang 19.1.5 构建),通过 Vulkan 后端,以 Ryzen HX 370 集成 GPU 运行 Qwen 3.6 27b Q8 模型时触发。复现命令中包含 --no-mmap 和
先解决问题,再了解资讯。选择你现在要完成的任务。

用户在 Windows 系统上使用 llama-cli 或 llama-server(版本 9484,基于 Clang 19.1.5 构建),通过 Vulkan 后端,以 Ryzen HX 370 集成 GPU 运行 Qwen 3.6 27b Q8 模型时触发。复现命令中包含 --no-mmap 和

用户在 llama.cpp b10048 (commit 2e1fd76) 上运行 llama-server 或 llama-cli ,使用 --spec-type draft-dflash 模式,配合官方 z-lab 提供的 DFlash 草稿模型(如 Qwen3-8B-DFlash-b16 或
![[Bug] Disabled Weaviate document vectors are not deleted by segment ID](https://www.chat-gpts.plus/wp-content/uploads/2026/07/39174-10c10356-768x403.jpg)
用户在 Dify 中配置 Weaviate 作为知识库的向量数据库,索引文档中的分段 (segment) 后,禁用或删除该文档时触发。该 Bug 存在于 Dify 主分支 ( main , commit 61b07ab17d ),使用 Docker 自托管部署。

AI 生成的低质量盗版书籍正大规模涌入 Apple Books 和 Amazon 等主流电子书平台,直接剽窃或模仿正版作者的标题、封面风格和内容,已有多位知名作者受害。平台虽在投诉后删除部分内容,但问题反复出现,暴露了内容审核机制的严重漏洞。

一位拥有20年经验的软件工程师在Hacker News上公开发文,控诉AI代码生成工具已从可选变为强制,使得整个软件开发流程——从代码编写、评审到设计文档——都变成了“AI垃圾(slop)”,并认为拒绝使用AI在职业上已不可行。

中国脑机接口公司 BrainCo 发布了首个集成式“脑控机器人”平台,用户戴上 EEG 头戴设备即可用意念操控机器人。这一进展将脑机接口从实验室推向了实际的机器人控制场景,降低了非侵入式脑控技术的使用门槛。

Anthropic 宣布,其最新模型 Claude Fable 5 将于 7 月 20 日面向付费用户开放,但不同订阅计划的调用额度差异很大。Max 和 Team Premium 用户可使用 50% 的配额,Pro 和 Team Standard 用户则需通过用量积分使用,高门槛可能会限制模型的实际普及速度。

用户展示了通过 API 将 AI 代码生成工具 Codex 与 Photoshop(PS)对接后的全自动操作流程,实现了从文字指令到 PS 内图层处理、滤镜应用的完整工作链。这一尝试将大模型的编程能力直接延伸至设计师的核心工具中,值得关注。

火山引擎基于豆包视频通话的真实大规模用户场景,自研了一套面向 AI 的多模态传输系统(MMT),以解决传统音视频技术在 Agent 交互中延迟、稳定性、成本等方面的问题,这一系统已在亿级 DAU 的豆包中落地验证,并开始对外输出。

多起真实案例显示,AI 智能体因凭证泄露后能在数小时内调用大模型 API 产生数万美元费用,而云平台账单告警存在 24 小时延迟,导致传统风控手段几乎完全失效。核心矛盾在于“自动化程序的消费速度”与“人工操作的慢速护栏”之间的结构性错配。