70强项目观察之前沿探索:AI进入科学发现,答案之外还要验证什么

世界人工智能开源大赛(GOAI)前沿探索赛道 20 个决赛项目覆盖材料、聚变、古文字、量子光学、虚拟细胞等方向,它们共同显示:AI 已不只是科研辅助工具,而是进入提出问题、生成候选、验证结果的全流程;但高分结果不等于科学发现,可验证、可复现、可质疑才是下一阶段的硬门槛。

世界人工智能开源大赛(GOAI)前沿探索赛道 20 个决赛项目覆盖材料、聚变、古文字、量子光学、虚拟细胞等方向,它们共同显示:AI 已不只是科研辅助工具,而是进入提出问题、生成候选、验证结果的全流程;但高分结果不等于科学发现,可验证、可复现、可质疑才是下一阶段的硬门槛。

中美已开始讨论建立一套 AI 事件互相通报机制,用于提示可能威胁国家安全的 AI 事故。这是全球两大 AI 强国第一次把“安全预警”摆上双边桌面,但美方同时明确,对华芯片出口管制不在讨论范围内。

产品人 Peter Yang 在 X 上分享了他对“个人智能体(personal agent)”竞争格局的观察,认为 Meta 旗下的 Muse 有望成为这一赛道的领先者,并同步推广其订阅量超过 11 万的 AI 与产品指南通讯。

亚马逊以违反平台使用条款为由,阻止 Meta 的 Muse AI 代理代替用户在其电商平台下单购物。这暴露出“代理式 AI”在跨平台执行任务时,与电商平台围绕数据、账号安全和商业利益的正面冲突。

联合国独立国际科学小组在首份专题简报中警告,各国不应等到完全弄清 AI 失控的成因,再着手加强保障措施,并援引“预防原则”为此提供依据。这份报告发布的时间点,恰逢中美就 AI 展开磋商、各国领导人齐聚纽约参加联合国大会。

阿里调整通义千问(Qwen)大模型团队负责人,由刘大一恒接掌,并计划在云栖大会前后对外亮相。这既是阿里大模型一号位的交接,也释放出通义系列继续加码、组织趋稳的信号。

百度文库网盘在 9 月 21 日百度 AI Day 上宣布加速 AI 办公产品出海,其通用 AI Agent 产品“库库”全球月活已超 4000 万,去年推出的海外平台 Oreate AI 同步升级为库库海外版,一年内海外用户突破 1000 万。

法国兴业银行预计,随着 AI 应用扩大,最多可节省 5 亿至 6 亿欧元成本,其中约 3.5 亿欧元已在 2029 年前的削减计划中落地。这家欧洲大型银行正通过与 Anthropic 合作部署 Claude 大模型,把 AI 算进了利润改善的核心账本。

月之暗面为 Kimi Code 推出 macOS 和 Windows 桌面客户端,把原本在浏览器里用的 AI 编程 Agent 搬到本地桌面,用户可以用对话方式读写代码、执行命令、跑自动化任务,不必再手动切换窗口。这一步意味着 AI 编程工具正从网页插件形态走向独立的本地开发入口。

微软用 AI Agent 把 GitHub Copilot 运行时从 43 万行 TypeScript 重写为 80 万行 Rust,token 成本约 12 万美元,换来约 15.9 倍性能提升和最多九成内存下降。