想到ACE?更少的Token就能搞定

IBM 研究团队发布 ALTK-Evolve,一种让 AI 智能体从自身历史轨迹中学习经验的记忆系统,在相同任务上以最高约七分之一的 token 消耗,达到或超越类似方案 ACE 的准确率——这直接关系到企业部署 AI 智能体的推理成本。

IBM 研究团队发布 ALTK-Evolve,一种让 AI 智能体从自身历史轨迹中学习经验的记忆系统,在相同任务上以最高约七分之一的 token 消耗,达到或超越类似方案 ACE 的准确率——这直接关系到企业部署 AI 智能体的推理成本。

OpenAI 扩大 Daybreak 网络安全计划,向 Accenture、IBM、CrowdStrike、Cloudflare 等合作伙伴开放专门训练的 GPT-5.6-Cyber 模型,用于漏洞挖掘和渗透测试,且该模型面对高风险任务时的拒绝率更低。这标志着 OpenAI 正把网络安全从防御场景拓展到攻防两…

开发者 Swyx 用同一句提示词分别让 GPT Luna Max 和 Claude Fable Ultracode 搭建 Grok Imagine 的克隆应用,结果两个模型给出了风格迥异的实现——Claude 系在视觉还原度上胜出,GPT 系则更准确地理解了“用开放模型+fal 跑通”的深层意图,做出更可用的…

一个代号为 mona-lisa-1 的 OpenAI 新图像模型悄悄出现在模型竞技场(Arena),经网友验证带有 SynthID 水印,确认来自 OpenAI。其生成效果明显改善了以往图像模型的“塑料感”,外界推测这可能是 GPT Image 2.5 的中杯版本。

OpenAI 发布网络安全专用模型 GPT-5.6-Cyber,在零日漏洞发现等高级任务上的完成率从普通模型的 1.5% 跃升至 95%,并用它挖出了 Chrome 浏览器、主流移动操作系统和数据库中的多处高危漏洞。

OpenAI 于周一发布了网络安全专用模型 GPT-5.6-Cyber,该模型在网络攻防任务中的完成率从上一代的 57.3% 跃升至 95.0%,但仅限通过其审查项目 Daybreak 访问。三天前 OpenAI 刚推迟了 Astra,一推一发看似矛盾,实则都遵循同一套安全评估框架。

维珍大西洋航空将 ChatGPT Work(ChatGPT 企业版)引入客户旅程研究、数据分析和产品规划,把原本耗时数周的竞品调研压缩到几小时内完成。这是企业级 AI 从“问答工具”走向“内部工作流基础设施”的一个具体案例。

网络安全AI公司Corma完成6000万美元种子轮融资,由红杉资本领投,专攻防御性AI基础模型。在模拟攻防测试中,通用大模型的攻击成功率达88%,防御捕获率仅12%,Corma希望为这个结构性缺口提供一个专门训练的解决方案。

一份面向非技术读者的《AI名词小白入门白皮书》出现在社区,核心不是罗列术语,而是提出一套分层框架,帮读者判断 GPT、RAG、MCP、Agent 这些词在 AI 系统中各自处于哪一层。它提示我们:背熟名词清单,不如先分清模型、产品、工具和执行机制之间的层级关系。

OpenAI 财务团队负责人撰文分享将 AI 深度嵌入财务职能的经验,提出“零日关账”和“持续预测”两大目标,并归纳了 CFO 可以复用的五条实践法则。这件事的意义在于:AI 正在把财务从“每月结账”的周期性工作,变成“实时看经营”的决策基础设施。