AI 强大到足以破解我们最难的数学难题——还会灭掉全人类

《华尔街日报》一篇报道提出,前沿 AI 在数学难题上的能力正在快速逼近人类顶尖水平,同时 OpenAI 与 Anthropic 等公司正把"AI 安全"与"AI 做数学研究"放在同一条主线上讨论,这既是科研工具的机会,也是风险治理的压力测试。

《华尔街日报》一篇报道提出,前沿 AI 在数学难题上的能力正在快速逼近人类顶尖水平,同时 OpenAI 与 Anthropic 等公司正把"AI 安全"与"AI 做数学研究"放在同一条主线上讨论,这既是科研工具的机会,也是风险治理的压力测试。

Meta 推出个人 AI agent「Muse」,主打帮普通人处理日程、邮件、旅行和长期目标,甚至能在应用关闭后继续推进任务。TechRadar 的评论认为,它更像是给硅谷职场人准备的配饰,对真实生活场景的理解存在偏差。

英伟达正洽谈以最多 100 亿美元参与 Anthropic 的 IPO 锚定投资,而 Anthropic 计划以约 2 万亿美元估值募资最多 1000 亿美元。这不只是一笔大额融资,更凸显英伟达“投资客户、再卖算力”的循环模式正在成为 AI 行业的基础设施级玩法。

有开发者在 2026 年 9 月发表技术文章,用纯 Node.js 独立复刻了 Codex 在选中 gpt-6-astra 模型后输入区域出现的"终端星光"动效,并逐行解释了这套观感为何克制的具体实现细节。

一家名为 iLands 的公司让 AI Agent 冒充人类写作者,向自由撰稿人批量发送约 25 美元的"代做研究"推销邮件。这些邮件以居高临下的口吻纠正收件人的内容错误,实质是在抢创作者的工作机会,而且没有退订选项。

中国电信研究院报告称,中国 AI 产业正从比拼大模型和算力规模,转向部署和销售 AI Agent,并预计到 2029 年推理将占中国算力市场 80%。与此同时,欧盟以 300 亿欧元预算推进最多七座 AI 超级工厂,但实际到位资金仅约 10 亿欧元。

QApilot 在 Product Hunt 上线了面向 Android 的 MCP 产品,把移动端质量保障与 AI 模型上下文协议结合起来,试图让测试、缺陷定位等环节可以由大模型直接调用工具完成。对做移动开发和测试的团队来说,这代表 AI 应用正从聊天窗口走向真实工程流水线。

DeepSeek 于 2026 年 9 月 10 日发布 V4.1 Flash,这是一款 552B 参数、原生多模态的 MoE 模型,从底座重新预训练,API 价格同步下调并合并旧模型入口。它把“小尺寸旗舰”的竞争推到了长任务 Agent 和上下文成本这两个具体维度上。

GitHub 上的 system_prompts_leaks 仓库持续收录 ChatGPT、Claude、Gemini、Grok 等主流聊天机器人的系统提示词原文,最新已更新到 Claude Fable 5.1、ChatGPT 5.6、Grok 4.6 等版本。它让原本写在“第一句话之前”的隐藏规则变成可公开…

GitHub 上出现了一个名为 claude-red 的开源技能库,通过一批结构化的 SKILL.md 文件,把 Claude 变成懂攻击方法论的红队操作员。它的价值不在模型本身,而在于给通用大模型按需加载垂直安全能力的这套玩法。