Eval bug: intermittent silent Qwen2.5-Omni audio corruption on Metal under system load (b10809)

该报错通常出现在 Apple Silicon 上用 llama.cpp Metal 后端、经由共享库(in-process)反复调用 Qwen2.5-Omni 音频推理时:负载下偶发返回 2,048 个乱码 token,但没有任何后端报错。优先排查采样是否可复现(temp 0 + 固定 seed)、

该报错通常出现在 Apple Silicon 上用 llama.cpp Metal 后端、经由共享库(in-process)反复调用 Qwen2.5-Omni 音频推理时:负载下偶发返回 2,048 个乱码 token,但没有任何后端报错。优先排查采样是否可复现(temp 0 + 固定 seed)、

该报错出现在 macOS + WebGPU(Dawn)后端运行 llama.cpp 测试套件时,主要集中在 hy_v4 架构的评测与保存/加载状态测试中,进程直接崩溃(SIGSEGV / SIGBUS)。优先排查 WebGPU 后端对 hy_v4 架构的支持情况,以及 CI 中 Dawn 依赖与构建

该问题出现在使用 llama.cpp 的 llama-server 运行推理速度约 100 T/s 的 reasoning 模型时,前端 Firefox 打开 WebUI 并生成较长的 reasoning 输出,导致客户端 Firefox 占用 100% 单核 CPU。优先排查方向是 WebUI 前

据《华尔街日报》报道,OpenAI 以超过 3 亿美元收购了智能手机摄像头公司 Glass Imaging,后者由两位前苹果工程师创办,擅长用神经网络在拍摄瞬间优化成像。这笔交易让 OpenAI 自研硬件的拼图又多了一块。

Anthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》,主张为前沿 AI 发展“定速”,随即引发 OpenAI、Google DeepMind、马斯克与特朗普政府高层的密集表态。这场争论的核心不是“要不要停”,而是“谁来定规则、按谁的标准定速”。

英伟达 CEO 黄仁勋在 All-In 峰会台上接到特朗普电话并开免提,两人共同反对“放缓 AI”的呼吁。这场公开表态把硅谷加速派与安全派的分歧,直接推到了政策层面。

Anthropic 于 9 月 14 日发布 Claude Code v2.1.271,带来远程会话 fast 模式、配置面板鼠标支持、自托管 runner 的 drain 标记等更新,同时集中修复了权限校验、企业策略缓存和多处沙箱绕过问题。这是一次偏企业级与稳定性的维护性版本,重点在可控性与合规性。

SpaceXAI 工程师 Lingxi Li 公开了自己用五个专属 Grok Bot 管理编码 agent 的工作方式,并给出一个月合入 2000+ PR、三周做出 iOS 版本等具体数据,展示了“一个工程师带一支 bot 团队”的新型研发形态。

AI 工程圈正在把注意力从"怎么写出好提示词"转向"怎么管理模型的整个上下文"——因为多数 Agent 失败已不是模型能力问题,而是上下文被稀释、淹没和遗忘的问题。

Anthropic CEO Dario Amodei 呼吁行业“为前沿模型设定节奏”,但什么是“节奏”、谁来定速度,五大阵营各说各话。这背后是 AI 算力监管从“要不要管”转向“用什么数字管”的真问题。