Microsoft 借助 Agent 把 Copilot 运行时迁移到 Rust,花了 12 万美元

微软用 AI Agent 把 GitHub Copilot 等产品的运行时从 TypeScript 迁移到 Rust,花费约 12 万美元 token 成本和三周人力,换来约 15.9 倍的性能提升和显著降低的内存占用。

微软用 AI Agent 把 GitHub Copilot 等产品的运行时从 TypeScript 迁移到 Rust,花费约 12 万美元 token 成本和三周人力,换来约 15.9 倍的性能提升和显著降低的内存占用。

Reddit 热门讨论指出,以压缩软件 WinRAR 为主业的德国公司 win.rar GmbH,其盈利能力可能优于仍在巨额亏损的 OpenAI。这一对比值得关注,因为它把 AI 行业的高投入、低利润问题放在了传统软件生意的参照系下。

微软与伊利诺伊大学提出 StudentSim,用少量数据为每个学生建立会犯真实错误、又能听懂辅导提示的数字副本,再让 AI 导师对着这些副本反复练手,从而绕开真人反馈昂贵且缓慢的瓶颈。

雷神首款 AI 移动工作站 AI Master M7000 将于 9 月 21 日 10:00 开售,搭载 AMD Ryzen AI Max+395、64GB 内存和专用 AI SSD,官方称可在本地运行 120B 参数大模型,补贴后售价 1.99 万元。

阶跃星辰发布旗舰基座模型 Step 5 Preview,采用 600B 总参数、单次仅激活 27B 的稀疏 MoE 架构,主打真实 Agent 任务场景,在多项高难度评测中接近 GPT-6Astra 与 Claude Opus5,同时把单任务成本压到后者的八分之一。

阶跃星辰发布下一代旗舰基座模型 Step5Preview,在 AI 编程、软件工程、金融等 Agentic 场景上发力,单任务成本仅为 Claude Opus5 的 1/8,并计划于 10 月 15 日正式开源。

GPT-6 Astra 与三位人类研究者合作,在 FrontierMath 基准上解决了一道 2017 年起悬置的"重大突破"级开放问题——证明"核心"不可能为空,即绝对公平的委员会在任何情况下都存在。这是 AI 首次参与攻克该级别数学难题,Epoch AI 榜单已为此新增"Human + AI"标签。

B站上线"AI 无限竞技场"测评榜,把上百个大模型的真实实测结果汇到一个公开榜单里,首轮由 GPT-6 Astra 居首。它值得关注的地方在于:评测权不再只握在少数机构手里,创作者的实际工作流成了排名依据。

B 站上线"AI 无限竞技场"大模型评测榜单,由不同分区 UP 主用真实工作流出题实测,首轮结果中 GPT-6 Astra 暂居第一,前五名有三款国产模型。它值得关注的地方在于:评测标准不再由厂商或固定跑分定义,而是由真实使用场景决定。

Hacker News 上围绕一个“人类能否分辨 AI 生成图片”的在线测试展开讨论,用户总结出一套判断经验:AI 图像往往有过于突出的主体、过强的景深和焦外虚化,构图也“完美得不自然”。这背后反映的是图像生成模型仍带有可识别的固定风格。