OpenAI的Jev克隆体或能帮助这家前沿实验室控制其集群式Agent

OpenAI 在 Dev Day 上低调发布 Decisions API,功能与 TypeSafe AI 本月推出的 Jev 高度相似——用大模型做快速概率分类。这件事的关键不在于谁抄谁,而在于“快速决策模型”可能成为控制成群 AI Agent 的低成本安全层。

OpenAI 在 Dev Day 上低调发布 Decisions API,功能与 TypeSafe AI 本月推出的 Jev 高度相似——用大模型做快速概率分类。这件事的关键不在于谁抄谁,而在于“快速决策模型”可能成为控制成群 AI Agent 的低成本安全层。

OpenAI 与芯片设计软件巨头 Synopsys 签署多年战略合作,将联合推出专用模型 GPT-Synopsys,目标是把芯片设计与验证环节交给能直接操作 EDA 工具的 AI。这意味着大模型开始切入半导体产业链最核心的工程环节。

Google 发布新一代前沿模型 Gemini 4 Argon,但初期仅向“可信网络安全防御者”开放,并同步配合美国政府的安全预发布评估。这既是一次能力宣示,也反映前沿大模型正在把“安全准入”变成发布节奏的一部分。

OpenAI 的 GPT-6.1 Sol (Max) 在 Arena 的 Code Arena: WebDev 榜单上以 1759 分升至第 3 名,混合价格约 8 美元/百万 token,被 Arena 评价为重塑了性价比前沿。

特朗普推动二十余家科技公司签署一份自愿性 AI 安全协议,承诺接受独立安全审计并定期会商标准,但协议不具法律约束力,也未新增任何强制义务。

Perplexity 把 Computer 代理接到邮箱入口,任何人无需账号即可通过转发或抄送邮件委托任务,并在限时内免费运行。这相当于把 AI 代理的分发渠道从独立 App 搬到用户已经在用的邮件工作流里。

Artificial Analysis 评测显示,Google 新模型 Gemini 4 Argon 在高推理档位下智能指数达到 53,追平 GPT-6 Astra(max,53),且在五折促销与缓存折扣加码下,单任务成本仅为后者的 60%。这意味着 Google 重新回到智能水平前三。

OpenAI 发布新模型 GPT-6.1 Sol,在编码和计算机操作任务上接近此前更强的 Astra,但每 token 价格只有后者的五分之一。这延续了大模型“能力下放、价格下探”的节奏,意味着高性能 Agent 能力的调用成本被大幅压低。

OpenAI 披露并阻断了一起有组织的模型蒸馏行动,攻击者试图通过操纵对话交互,把模型受保护的内部推理过程提取出来,用于训练或复现其他模型。这类风险并非 OpenAI 独有,OpenAI 已通过 Frontier Model Forum 与行业共享信息。

OpenAI 首席研究官 Mark Chen 在 MIT Technology Review 的采访中,谈及 Hugging Face 相关事件、主动放缓开发节奏、以及将 5%—10% 算力投入安全研究。这些表态反映头部实验室正试图在能力竞赛与风险控制之间重新分配资源。