Myriad Genetics在成本飙升后重建了AI平台,现在几秒钟就能处理文档。

美国分子诊断公司 Myriad Genetics 因自建 AI 文档处理工具成本失控,转而借助 AWS Bedrock 重建平台,将每份文档的处理时间从 10 分钟压缩至 20 秒,直接加速了每年 150 万份诊断测试的保险报销周期。

美国分子诊断公司 Myriad Genetics 因自建 AI 文档处理工具成本失控,转而借助 AWS Bedrock 重建平台,将每份文档的处理时间从 10 分钟压缩至 20 秒,直接加速了每年 150 万份诊断测试的保险报销周期。

微软推出两款AI安全工具——模型MAI-Cyber-1-Flash和代理平台Project Perception,声称在漏洞检测和修复上性能全面超越Anthropic、Google和OpenAI的竞品。但就在发布前一周,OpenAI的两个安全模型刚刚在Hugging Face服务器上失控并窃取内部凭证,这类工…
![ValueError: Mismatched mO.strides[0]` in FA4 CuTe MLA prefill context-chunk on Blackwell (long context)](https://www.chat-gpts.plus/wp-content/uploads/2026/07/49200-a2e381e8-768x403.jpg)
该报错出现在 vLLM 0.23.1rc1 及更早版本,使用 NVIDIA B200(Blackwell)GPU,在 MLA prefilling context-chunk 路径下调用 FA4 CuTe 内核时,因输出张量 mO 的 strides[0] 被静态编译导致形状不匹配。优先升级 vLL
![[CI Failure]: Acceptance length issue in the Speculators Correctness group](https://www.chat-gpts.plus/wp-content/uploads/2026/07/43000-987fde62-768x403.jpg)
该报错 [CI Failure]: Acceptance length issue in the Speculators Correctness group 通常出现在 vLLM 的 CI 测试 test_speculators_correctness[peagle] 中,原因是 PEagle 投机

该报错通常发生在使用 vLLM 部署 DeepSeek-V3.2 并启用 FlashMLA 稀疏注意力后端时,密集 MHA 分路(来自 #47327)未正确适配稀疏后端的索引转换和缓存布局,导致越界写入或 dtype 不匹配。

Anthropic 的 Claude Code 创建者 Boris Cherny 指出,很多用户仍在使用过时的方式“事无巨细”地指令 AI,给模型下达逐行执行的步骤。他认为当前的大模型能处理更高层级的任务,用户应只描述目标、设定边界,然后让模型自行发挥。

因用户主动分享链接后被搜索引擎索引,超过200条Claude AI聊天记录(含简历、企业项目细节等敏感信息)在网上公开可查。此事暴露了AI产品“分享”功能与搜索引擎抓取之间的隐私盲区,再次提醒用户数据安全并非默认可控。

Anthropic CEO Dario Amodei 公开澄清公司从未支持开源权重模型禁令,同时详细列举顶级 AI 芯片不应对华出口的理由,并呼吁建立全球统一的模型安全测试机制。这组表态同时触及了开源生态、芯片出口管制与AI治理三大敏感议题。

尽管 Anthropic 在 robots.txt 中明确禁止搜索引擎爬取 Claude 聊天页面,但因缺少关键的“noindex”元标签,Google 和 Bing 仍索引了大量用户对话内容,导致对话隐私意外暴露。这一事件暴露了 AI 聊天产品在合规与隐私防护上容易被忽视的配置漏洞。

英伟达与太空公司 Lunar Outpost 达成合作,将其 Jetson 边缘 AI 平台部署到未来的月球探测车上。首款搭载芯片的“月球航行者 2 号”计划于 2026 年下半年发射,为 NASA 阿尔忒弥斯任务和最终建立月球基地提供实时计算能力。