OpenAI 将 Codex 模型上下文大小从 372k 缩减至 272k

OpenAI 悄然将 Codex 模型的可用上下文大小从 372k 缩减到 272k,用户发现早期频繁出现的“模型上下文大小超限”错误已不再出现。随着上下文缩减,OpenAI 开始采用类似加密子代理日志的方式隐藏会话细节,引发部分高级用户对透明度和可控性的担忧。

OpenAI 悄然将 Codex 模型的可用上下文大小从 372k 缩减到 272k,用户发现早期频繁出现的“模型上下文大小超限”错误已不再出现。随着上下文缩减,OpenAI 开始采用类似加密子代理日志的方式隐藏会话细节,引发部分高级用户对透明度和可控性的担忧。

美国德州一位在职母亲通过向 Anthropic 的 Claude 发送语音备忘录,实现从日程整合、生日礼物推荐到育儿计划的一站式生活管理。这展示了大语言模型在非技术用户日常场景中的实用落地,也暴露了语音交互在家庭环境中的认知成本。

OpenAI 在 2026 年 7 月 18 日合并了一个 Codex 代码库的 Pull Request(#33972),其中包含了对模型元数据的更新,将 Codex 模型的上下文窗口从 372,000 tokens 缩减至 272,000 tokens。这一“倒退”式的调整引发了开发者社区对模型能力稳定性…

月之暗面(Moonshot AI)的最新模型Kimi K3在Code Arena前端代码基准测试中超越Claude Fable 5和GPT-5.6 Sol,成为首个登顶该榜单的中国模型;但在Epoch AI发布的FrontierMath Tier 4专家级数学测试中,仅取得约39%的正确率,远低于OpenAI…

美国云服务商Box CEO Aaron Levie 和知名投资人 David Sacks 公开指出,试图通过封锁或限制模型来阻止中国 AI 进步的做法已行不通,因为中国 AI 在极短时间内追上了前沿水平。他们认为,美国应以更快的开放、更强的基建和更安全的扩散来保持全球竞争力,而非依赖“造围墙”。

Anthropic 宣布其新模型 Claude Fable 5 将于 2026 年 7 月 20 日纳入 Max 和 Team Premium 计划,并以 50% 配额形式提供。由于需求激增和交付压力,内部团队曾“几乎昼夜不休”地赶工完成上线。

一位父亲与8岁女儿共同使用ChatGPT的“ChatGPT Sites”功能,创建了一个乘法表学习网站,全程不写代码,仅靠对话式AI完成UI设计、角色生成和游戏机制开发。这一案例展示了ChatGPT从“对话工具”向“应用生产平台”的进化,以及对非技术用户的普及意义。

Zara Zhang 在 X 上提出,每个人都应为 AI 模型开发自己的“个人评估集”——一组与日常工作生活真正相关的任务,而非仅依赖行业基准。这一观点强调,用户通过主动测试模型边界,才能发现其实际可用性,而非盲目相信排行榜。

一位资深 AI 产品用户 Thibault Sottiaux 在 X 上分享了自己将日常工作全部委托给 ChatGPT Work 并依赖听写功能的体验,引发广泛讨论。这说明 AI 助手正从辅助工具变为核心工作代理,但也暴露了过度依赖带来的效率与控权问题。

OpenAI 合作伙伴通过语音指令让 ChatGPT Work 自动抓取 Twitter 私信、整理为分类表格并评估用户成熟度,展示了 ChatGPT 从对话工具向可执行多步骤任务的智能助手的跃迁。