你本可以想出Kimi Delta Attention

一篇技术博客深入解构了Kimi与Qwen等模型背后的线性注意力机制“Kimi Delta Attention”(KDA),并指出其核心路径其实可以基于基础假设推导出来,这揭示了当前长上下文模型在效率上的设计思路,而非不可理解的黑箱。对于关注模型推理效率和成本的人来说,这提供了一个极其清晰的观察窗口。

一篇技术博客深入解构了Kimi与Qwen等模型背后的线性注意力机制“Kimi Delta Attention”(KDA),并指出其核心路径其实可以基于基础假设推导出来,这揭示了当前长上下文模型在效率上的设计思路,而非不可理解的黑箱。对于关注模型推理效率和成本的人来说,这提供了一个极其清晰的观察窗口。

美国最大电网运营商PJM宣布,为避免电力系统崩溃,将从2027年6月起对部分大型数据中心实施临时断电。这标志着AI算力扩张带来的能源供需矛盾,已从行业内部成本问题上升为区域性基础设施安全危机。

GitHub 的 Dependabot 现在能够从 OpenSSF(开源安全基金会)的恶意软件包仓库中获取警报信息,覆盖范围从原有的 npm 扩展到了 PyPI 等多个生态。这意味着开发者无需额外配置即可获得更广泛的供应链安全告警。

LiquidAI 于 2026 年 7 月 28 日发布了两款通用编码器模型 LFM2.5-Encoder-230M 和 350M,核心优势是在 CPU 上处理超长文本(8192 token)时,速度比同尺寸的 ModernBERT-base 快约 3.7 倍,同时性能可匹敌或超越体积更大的竞品。

最新研究证实,大多数企业虽然积极批准AI预算,但大量投入仍停留在实验和测试阶段,尚未转化为可运行的生产系统。钱不是浪费了,而是被“停放”在预生产环节,企业AI项目从实验到落地的转化缺口正在成为云服务领域一个不容回避的问题。

AI 热潮导致数据中心电力消耗激增17%,预计到2030年三分之一美国数据中心将彻底脱离电网。电力短缺正从“后勤问题”变成AI部署的核心瓶颈,谁控制电力谁就赢得竞争。

NVIDIA投资了Ilya Sutskever领导的AI实验室Safe Superintelligence(SSI),并提供下一代Vera Rubin GPU平台,使SSI从依赖Google TPU转向NVIDIA算力。此举既加固了NVIDIA在AI芯片领域的竞争壁垒,也为SSI冲刺“安全超级智能”提供了十倍…

台湾检方以涉嫌伪造文件和背信为由,拘留了一名英伟达(Nvidia)员工,同时搜查了英伟达台北办公室。该员工被指参与向中国非法出口搭载英伟达受管制芯片的超微(Super Micro)AI服务器,这是美国出口管制延伸至供应链末端的又一典型案例。

Recursive Superintelligence 与亚马逊 AWS 签署了 4.1 亿美元的算力协议。这家致力于「递归自我改进」(RSI)的 AI 公司把融资的大部分押注在算力上,并计划在 2026 年 10 月推出首批产品。

Perplexity 在 Windows 上推出了名为“Personal Computer”的本地 AI 智能体系统,能协调 15 个以上模型与子代理,读取编辑本地文件、连接 400+ 应用,并借助持久记忆系统“Brain”实现上下文连贯。这不再是聊天式 AI,而是直接落到桌面操作系统层面的任务编排工具。