Meta 发布 Muse Spark 与数学家协作完成的六篇数学研究论文

Meta 公布与数学家合作完成的六篇数学研究论文,其中五篇给出了此前未解问题的答案,研究者直接通过 meta.ai 网页端使用 Muse Spark 1.1 和 1.2 的 Thinking 模式,而非定制科研系统。这为"通用大模型能否参与真正的前沿研究"提供了一个可核查的样本。

Meta 公布与数学家合作完成的六篇数学研究论文,其中五篇给出了此前未解问题的答案,研究者直接通过 meta.ai 网页端使用 Muse Spark 1.1 和 1.2 的 Thinking 模式,而非定制科研系统。这为"通用大模型能否参与真正的前沿研究"提供了一个可核查的样本。

Epoch AI 估算,2025–27 年出货的 HBM 显存最多可支撑约 3000 万至 1.7 亿个并发前沿模型智能体,若采用高推理效率模型甚至可达 19 亿个,但需求能否跟上仍存疑。

ChatGPT 上线了名为 Finances 的个人财务管理功能,把订阅排查、账单追踪、预算、信用分、债务和投资组合分析等能力整合进对话界面,入口为 chatgpt.com/finances。这意味着 ChatGPT 正从通用助手向需要长期授权个人数据的财务场景延伸。

Meta 让数学家直接通过 meta.ai 聊天界面,用 Muse Spark 1.1/1.2 的 Thinking Mode 协作攻克尚无已知解法的开放数学问题,并公布了六篇论文;关键在于这套流程没有定制化科研脚手架,走的是普通用户产品入口。

Anthropic 的 Claude Sonnet 5.5 首次进入 Arena 的 Agent Arena 榜单,排在第 3 名,净改进分为 +12.5%,但每任务中位成本达 2.74 美元,未能进入性价比 Pareto 前沿。

GitHub 于 2026 年 10 月 2 日一次性弃用了 Copilot 中的四款模型,覆盖 Gemini、Kimi 和 Claude 三条产品线。这不只是版本清理,而是 Copilot 模型供给策略在向更新、更集中的方向收拢,直接牵动开发者的日常工具配置。

一个名为 agent-wow 的开源项目让 GPT-6 Astra 驱动的 Codex 代理首次进入《魔兽世界》,在 40 分钟内零死亡完成兽人新手村全部任务,验证了大模型在未专门训练的游戏环境中自主推理与执行的能力。

一位有数十年软件经验的创业者把 AI agent 产品 Instinct 当同事来用,结果它不只是回答问题,还主动完成了改文案、建社媒、剪视频、做竞品分析甚至填报海关申请等具体工作,这展示了 AI agent 从聊天工具向可执行任务的工作伙伴转变的实际可能性。

据 CNN 9 月 18 日一则尚未被其他主流媒体独立核实的报道,美军一份由聊天机器人生成的情报错误声称一艘中国船只载有核武器部件,美方一度准备拦截,临执行前复核才发现内容有误。Timnit Gebru 与 Emily M. Bender 在《卫报》撰文指出,这比假设中的“超级智能”风险更紧迫。

斯洛文尼亚 .si 域名 9 月注册量从 8 月的约 2000 个暴涨到 4.4 万个,而 BBC 报道将其与特朗普把 AI 改称“超级智能”(super intelligence)联系起来,这一表述变化正在引发实际的市场反应。