DeepSeek-V4-Flash 接入 Codex(Windows 版)

开发者分享了一项 Windows 版 Codex 的配置方案,让 OpenAI 的 AI 编程工具 Codex 可以切换调用 DeepSeek-V4-Flash,并与原有 ChatGPT 登录态互不干扰。背后是 AI 编程工具从绑定单一模型走向多模型自由切换的趋势。

开发者分享了一项 Windows 版 Codex 的配置方案,让 OpenAI 的 AI 编程工具 Codex 可以切换调用 DeepSeek-V4-Flash,并与原有 ChatGPT 登录态互不干扰。背后是 AI 编程工具从绑定单一模型走向多模型自由切换的趋势。

麻省理工学院一项新研究发现,大语言模型给出的财务建议整体质量超出预期,能引导多数人建立更健康的储蓄和投资习惯;但建议质量高度依赖提问方式,模型在应对失业、投资组合再平衡等复杂场景时仍有明显短板。

Hacker News 用户发现,Cursor 在用量页面和 CSV 导出中移除了成本信息,同场讨论中还公布了六款 AI Agent 框架在同一任务下的 token 消耗对比,结果差距接近 30 倍。事件核心不是模型性能,而是 Agent 基础设施正在成为新的成本战场。

AI 模型开始直接否证数学家几十年未解的猜想,从"辅助工具"变成了"解题伙伴",数学界正在分裂为拥抱派和警惕派——真正的冲突不是 AI 能不能做数学,而是人还要不要做数学。

杨立昆公开否认“通用智能”存在,认为人类智能本身高度专用化;但最新评测和商业化数据却显示认知通用性已有实质进展。这场争论本质是“G”的定义权之争,而不是对大模型能力的一票否决。

一位健身爱好者用同一份需求分别向新版 Siri AI 和 ChatGPT 索要居家增肌计划,在私人教练评估后判定 ChatGPT 的方案更完整、更可持续,而 Siri 的生成结果虽简洁,却在训练时长、营养建议和长期规划上存在明显短板。

OpenAI 通过发布一篇数学报告,首次正式确认下一代模型家族名为“Astra”,并宣称其内部版本解出了十个十年未破的数学难题。这不仅是一次技术展示,也意味着 AI 在长时间、多代理协作任务上迈出了具体一步。

有人用 Qwen 系列的 8B 小模型跑出了一个国际象棋 AI,Elo 约 1500,能稳定击败多个前沿大模型和 Stockfish 最低难度,每步棋只需 1-2 秒。这件事的价值在于:小模型在特定任务上,正用远低于旗舰模型的成本做出可用表现。

OpenAI 正在开发代号 Astra 的新模型系列,专门面向需要连续工作数小时甚至数天的复杂任务。它已在测试中解决了 10 个搁置十年的数学难题,并将成为首个接受美国联邦政府上线前审查的 OpenAI 模型。

DeepSeek 于 7 月 31 日发布 V4 Flash——一款 284B 总参数、仅激活 13B 的 MoE 架构模型,在多项 Agent 基准上超越自家旗舰,API 价格仅为 GPT-5.5 的约 1/35,把“高性能 + 极低成本”的组合推向新边界。