OpenAI 周五因网络风险暂停了一款模型,周一又发布了一款经训练、拒绝率更低的模型。

OpenAI 于周一发布了网络安全专用模型 GPT-5.6-Cyber,该模型在网络攻防任务中的完成率从上一代的 57.3% 跃升至 95.0%,但仅限通过其审查项目 Daybreak 访问。三天前 OpenAI 刚推迟了 Astra,一推一发看似矛盾,实则都遵循同一套安全评估框架。

OpenAI 于周一发布了网络安全专用模型 GPT-5.6-Cyber,该模型在网络攻防任务中的完成率从上一代的 57.3% 跃升至 95.0%,但仅限通过其审查项目 Daybreak 访问。三天前 OpenAI 刚推迟了 Astra,一推一发看似矛盾,实则都遵循同一套安全评估框架。

Zapier 企业营销团队用 ChatGPT Work 实现了销售线索漏斗的自动化质检与修复,每月可处理数千条线索,并为销售团队带来七位数美元的管道价值。这标志着 ChatGPT 正从对话助手走向可独立执行任务的 Agent 产品。

一位开发者通过浏览器调试工具发现,ChatGPT 在真正联网搜索前,就已经在内部搜索词里写好了要推荐的品牌名单。这意味着“被 AI 推荐”这件事,可能在你的网站被访问之前就已经决定了。

Hacker News 上一则题为“GPT 5.6 Cyber”的讨论,暴露了 OpenAI 安全审查机制的一个具体断点:有用户仅仅打开又关闭 Persona 标签,就被接口以“网络验证预检失败”为由拒绝访问。这个看似微小的错误码,折射出 AI 安全合规系统在精确判断用户意图上的困境。

美国众议院民主党人向议长 Mike Johnson 施压,要求 OpenAI、Anthropic 等头部 AI 公司 CEO 就近期安全事件宣誓作证,同时已向两家公司发出具体质询信,要求 8 月 24 日前答复。

Anthropic 将 Claude Sonnet 5 的入门价永久固定为每百万输入 token 2 美元、每百万输出 token 10 美元,原定 9 月 1 日的涨价计划取消。在主流大模型厂商普遍提价回收算力成本的背景下,这一逆势决策值得关注。

Meta发布了开放权重模型Muse Glimmer,CEO扎克伯格同步发表6500字长文为开源路线辩护。这被业界视为Meta在AI竞赛落后后的一次关键回归,但围绕“开放”的诚意与商业矛盾也引发争论。

Anthropic 公布了一个未发布 Claude 模型尝试攻克黎曼猜想的测试细节:它没有证明这一世纪难题,却在相关问题上取得了"意料之外"的进展。值得关注的不只是结果,而是前沿大模型在长链条数学推理上展现出的能力边界。

OpenAI以8520亿美元估值,通过要约收购向现任及前任员工回购约70亿美元股份。估值与最近一轮融资持平,此次操作的核心不是融资,而是为员工提供流动性,同时向市场传递公司价值稳定的信号。

TechRadar 编辑用 Gemini Live 的摄像头询问“鸡肉沙拉是否还能吃”,Gemini 没有直接回答,反而先念了一段医疗免责声明。这件事表面是日常生活的 AI 问答,实际反映了生成式 AI 进入健康建议场景时,大模型如何先规避责任风险、再谈用户体验。