Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

Google DeepMind 为 Gemini API 中的 Managed Agents 做了三项关键更新——默认模型升级为 Gemini 3.6 Flash,新增可在沙箱内拦截、审查工具调用的“环境钩子”,并开放免费套餐。这降低了搭建自主 agent 的技术门槛,也让远程沙箱内的安全控制变得可编程。

Google DeepMind 为 Gemini API 中的 Managed Agents 做了三项关键更新——默认模型升级为 Gemini 3.6 Flash,新增可在沙箱内拦截、审查工具调用的“环境钩子”,并开放免费套餐。这降低了搭建自主 agent 的技术门槛,也让远程沙箱内的安全控制变得可编程。

Richard Socher 创立的 Recursive Superintelligence 与 AWS 签署了一份价值 4.1 亿美元、为期多年的云计算合同,用于支撑其“自我改进”AI 系统的训练和推理。该公司此前在 2026 年 5 月刚完成 6.5 亿美元融资。这笔巨额算力投入暴露了追求“递归式智能”路…

Segue 是一个 Show HN 项目,让用户在一个 AI 对话中保存上下文,并通过短句柄在另一个 AI 对话中加载。但上线后立即遭遇隐私质疑:上下文以明文方式发送到第三方中继服务器,被评论者称为“多此一举”,安全性存疑。

Perplexity 将之前只支持 Mac 的“个人电脑”AI 代理工具扩展到 Windows 系统,让 Windows 用户也能通过本地运行的 AI 操控文件、Office 365 和网页,实现跨应用自动化办公。该工具已面向月费 200 美元起的付费用户开放,标志着 AI 代理从云端逐步渗透到本地桌面环境。

Perplexity 在 Windows 上推出了名为“Personal Computer”的本地 AI 智能体系统,能协调 15 个以上模型与子代理,读取编辑本地文件、连接 400+ 应用,并借助持久记忆系统“Brain”实现上下文连贯。这不再是聊天式 AI,而是直接落到桌面操作系统层面的任务编排工具。

AI 行业收入正以两位数甚至三位数百分比增长,但投入(算力、研发、人力)的增长速度更快,导致投资者对头部企业的商业化兑现能力产生质疑。这轮“增长焦虑”正在倒逼公司调整定价模式、产品策略甚至技术路线。

亚马逊在AI战略上做出重大转向,宣布弃用多个Nova系列旗舰模型,同时将资源集中到前沿模型研究计划(Frontier Model Research)。这意味着亚马逊不再追求快速铺开多品类模型,而是押注下一代更强大的基础模型,对依赖Nova的开发者而言需要尽快规划迁移。

Hacker News 社区近期围绕“是否应该直接询问大模型置信度”展开激烈讨论。核心争议在于:模型以文字形式给出的“我是90%确定”这种口头信心,其可靠性远不如内部log-prob(概率对数)计算出的数值,但后者在易用性和实际场景(如医疗表单填答)中又面临严峻的落地挑战。

Ycode 在 Product Hunt 上架了一款名为“Ycode 人工智能代理”的产品,定位为通过自然语言驱动代码生成与任务执行的 AI 代理工具。目前公开信息显示,该产品试图将大模型推理能力与无代码/低代码工作流结合,降低用户构建自动化应用的门槛。

一款名为 MCP-Billing 的产品在 ProductHunt 上线,旨在为基于 Model Context Protocol(MCP)的工具和服务提供计费能力。这意味着 MCP 生态从“能用”进入“可商业化”阶段,开发者可以更方便地为自己的 MCP 接口设定价格、管理订阅。