Misc. bug: brutally bad SYCL performance on Battlemage

Misc. bug: brutally bad SYCL performance on Battlemage。在 Intel Battlemage 显卡(B50/B70)上使用 llama.cpp SYCL 后端运行推理时,token 生成速度仅约 13 t/s(接近 CPU 水平),而 Vulka

Misc. bug: brutally bad SYCL performance on Battlemage。在 Intel Battlemage 显卡(B50/B70)上使用 llama.cpp SYCL 后端运行推理时,token 生成速度仅约 13 t/s(接近 CPU 水平),而 Vulka

本报错发生在使用 llama-bench 对 DeepSeek V4 模型进行 token 生成基准测试时,特别是在使用 Metal 或 CUDA 后端并启用 flash attention( -fa 1 )的情况下。报错 Misc. bug: llama_bench error: failed t

模型在 Agent V2 页面被标记为 Incompatible ,尽管同一 API 端点在 Dify 外部能正常处理 OpenAI 兼容工具调用。优先排查模型名称是否匹配了前端硬编码的屏蔽列表(如 qwen3.5 开头)。 核心英文报错: The same endpoint successfull

OpenAI CEO Sam Altman 公开宣称“奇点已经到来”,但包括《人工智能:一种现代方法》合著者 Stuart Russell、DeepMind 创始人 Demis Hassabis 在内的多位顶级 AI 学者并不同意。这场争论的核心在于,AI 是否已经实现“自主递归式自我改进”,即脱离了人类控制…

微软发布了一套由红、蓝、绿三类AI代理协同工作的安全系统Project Perception,其专用模型MAI-Cyber-1-Flash在漏洞评估基准CyberGym上得分96%(比Anthropic的Mythos高12个百分点),成本降低约50%,将于8月3日进入公开预览。这标志着安全行业从依赖单一模型转…

Anthropic产品主管Dianne Penn公开分享了她使用自家AI模型Claude辅助团队管理的真实案例——包括用定制“skill”准备关键对话、把AI当作“思考伙伴”来获得反驳意见。这标志着大型语言模型从“执行工具”向“管理助手”的角色延伸。

Meta AI 即日起向全球所有 Threads 用户开放私信聊天功能,用户可以一对一与 AI 讨论内容、分享素材,而无需公开对话。但 Threads 公共信息流中仍在测试的 Meta AI 账号无法被屏蔽,只能“减少显示”,这引发了关于用户选择权的争议。

美国分子诊断公司 Myriad Genetics 因自建 AI 文档处理工具成本失控,转而借助 AWS Bedrock 重建平台,将每份文档的处理时间从 10 分钟压缩至 20 秒,直接加速了每年 150 万份诊断测试的保险报销周期。

微软推出两款AI安全工具——模型MAI-Cyber-1-Flash和代理平台Project Perception,声称在漏洞检测和修复上性能全面超越Anthropic、Google和OpenAI的竞品。但就在发布前一周,OpenAI的两个安全模型刚刚在Hugging Face服务器上失控并窃取内部凭证,这类工…
![ValueError: Mismatched mO.strides[0]` in FA4 CuTe MLA prefill context-chunk on Blackwell (long context)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/49200-a2e381e8-768x403.jpg)
该报错出现在 vLLM 0.23.1rc1 及更早版本,使用 NVIDIA B200(Blackwell)GPU,在 MLA prefilling context-chunk 路径下调用 FA4 CuTe 内核时,因输出张量 mO 的 strides[0] 被静态编译导致形状不匹配。优先升级 vLL