微软 AI Gateway 新层级引热议:统一治理背后的权限隐忧

微软推出了 Azure API Management 的专用 AI Gateway 层公开预览版,把模型、工具和 MCP 服务器的发布与治理统一到一个网关里。它解决多云模型接入和成本管控的痛点,但密钥作用域过宽、无 SLA 以及与既有网关如何共存等问题,仍需谨慎评估。

微软推出了 Azure API Management 的专用 AI Gateway 层公开预览版,把模型、工具和 MCP 服务器的发布与治理统一到一个网关里。它解决多云模型接入和成本管控的痛点,但密钥作用域过宽、无 SLA 以及与既有网关如何共存等问题,仍需谨慎评估。

Okta正在尝试用MCP作用域控制来管理AI Agent的权限边界,从而降低token消耗和调用成本。这背后的思路是:Agent能访问的数据范围越清晰,拉入上下文的无效信息就越少,推理成本也就越低。

Anthropic 将 Claude 的 Chrome 侧边栏升级为跨设备同步的完整工作会话,浏览器不再只是一个问答入口,而成为桌面、网页、移动端之间连续工作的中场。这个变化直接关系到 Claude 在多设备场景下的实用性和用户粘性。

Anthropic 在推广 Claude for Chrome 浏览器插件的同时,公开承认浏览器代理可被网页内隐藏指令诱导,并发布防御方案与用户安全习惯建议。这件事说明 AI 代理从“能用”走向“可信”时,提示注入已成为必须正视的安全门槛。

谷歌在Gemini中新增14个第三方应用集成,让用户通过自然语言跨应用完成预订、日程、娱乐等任务。这是谷歌用“应用连接”策略扩展AI助手能力边界、对抗OpenAI和苹果生态的重要动作。

据《华尔街日报》报道,Google DeepMind CEO 德米斯·哈萨比斯在卸任前已与美国政府高层沟通,计划推动建立一家对标国际原子能机构(IAEA)的"AI 行业安全组织"。这位全球最顶尖 AI 实验室的掌门人,正在从技术管理者转向行业治理规则的设计者。

Anthropic 宣布,Chrome 浏览器侧边栏里的 Claude 现在运行与桌面端、网页端、移动端完全相同的 Claude Cowork 会话,会话跟随账户而非设备,用户可以跨终端无缝接续未完成的工作。这项能力今天起对 Max 和 Team 用户开放,Pro 用户将在未来几周内获得。

SpaceXAI发布了面向Agent场景调优的Grok 4.6模型,将上下文窗口提升至50万tokens,直接回应了当前AI编程与知识工作中对长文本处理能力的刚性需求,也意味着商业大模型的竞争从“参数规模”转向“实际工作负载承载能力”。

据英国《金融时报》报道,Anthropic 的投资者预计该公司将于今年 10 月启动 IPO,目标估值可能达到 2 万亿美元以上。若落地,这将是历史上规模最大的 IPO,也是 AI 商业化能力的一次集中检验。

OpenAI 的编程代理 Codex 桌面应用现已支持 Linux,补齐了其在桌面开发环境上的关键平台缺口。Linux 是后端与基础设施工程师的主力系统,这意味着 Codex 将直接进入大量核心开发者的日常工具链。