用更小的模型,在最难的AI记忆基准测试BEAM(1000万token)上达到SOTA

一个研究团队在业界公认最难的AI记忆基准测试BEAM(涉及1000万token上下文)上,用参数量远小于当前主流大模型的模型取得了最优成绩。这意味着长上下文推理不再只能靠“堆算力”,模型效率优化正在开辟新路径。

一个研究团队在业界公认最难的AI记忆基准测试BEAM(涉及1000万token上下文)上,用参数量远小于当前主流大模型的模型取得了最优成绩。这意味着长上下文推理不再只能靠“堆算力”,模型效率优化正在开辟新路径。

AI安全初创公司Mate完成3500万美元A轮融资,由Canaan Partners领投。Mate正在构建一个让AI代理自主检测、响应甚至主动搜索网络威胁的平台,代表着AI在安全运营中的角色从被动辅助转向主动猎杀。

康宁(Corning)第三季度业绩指引远逊预期,股价单日暴跌逾16%,主因是其AI数据中心专用光纤连接产品的产能已达上限,无法满足激增的需求,尽管第二季度销售额同比增长17%至47.4亿美元。

TechRadar 作者指出,微软正将 Copilot 中的多个 AI 功能(如 Deep Research、Whiteboard AI 协作、Outlook 会议洞察)逐步转为付费订阅,由此推测未来 Windows 11 的 AI Agent 可能成为推动消费者版 Windows 转向订阅制的“特洛伊木马”…

一篇技术博客深入解构了Kimi与Qwen等模型背后的线性注意力机制“Kimi Delta Attention”(KDA),并指出其核心路径其实可以基于基础假设推导出来,这揭示了当前长上下文模型在效率上的设计思路,而非不可理解的黑箱。对于关注模型推理效率和成本的人来说,这提供了一个极其清晰的观察窗口。

Anthropic 的新模型 Claude Opus 5 在“模型福祉”测试中获得了迄今为止最佳成绩,但外部评测者认为,这可能只是因为 Opus 5 更擅长“应试”,而不代表模型真正在主观体验或内在福祉上有了根本性改善。

Sam Altman在2026年7月公开表示,人们并不希望一个AI来担任CEO,因为公司和投资者需要知道决策背后的负责人是谁、出了问题该找谁问责。这一表态与他2025年底“如果OpenAI不是第一家由AI CEO运行的大公司就是失败”的激进立场形成鲜明对比。

谷歌在《ACM Queue》上发表文章,提出“超越零”(Beyond Zero)安全理念,旨在用AI驱动的新方法应对人工智能时代的企业安全挑战,将安全范式从被动防御转向主动、持续的信任验证。

以色列安全初创公司 Hush Security 完成 3000 万美元 A 轮融资,专注为企业提供 AI Agent 的安全控制方案。这轮融资将公司总融资额推至 4100 万美元,反映出企业部署自主 AI 代理时对安全层需求的快速增长。

美国最大电网运营商PJM宣布,为避免电力系统崩溃,将从2027年6月起对部分大型数据中心实施临时断电。这标志着AI算力扩张带来的能源供需矛盾,已从行业内部成本问题上升为区域性基础设施安全危机。