微软新发布的 MAI Code 1.1 Flash 在价格和性能上都被 Deepseek 碾压了。

微软发布专为 GitHub Copilot 设计的新代码模型 MAI Code 1.1 Flash,虽然比上一代更便宜、更高效,但在性能和价格上双双落后于开源的 DeepSeek-V4-Flash,引发外界对微软模型策略的质疑。

微软发布专为 GitHub Copilot 设计的新代码模型 MAI Code 1.1 Flash,虽然比上一代更便宜、更高效,但在性能和价格上双双落后于开源的 DeepSeek-V4-Flash,引发外界对微软模型策略的质疑。

腾讯在 Q2 财报中交出了一份以 AI 为核心的答卷——混元大模型快速迭代,定位更高参数规模的 Hy4 即将发布;办公智能体 WorkBuddy 已在国内形成领先优势;微信 AI 助手“小微”正扩大灰度测试范围。腾讯正从模型、应用到基础设施三个层面同步加码,试图把 AI 能力转化为实际商业回报。

Box CEO Aaron Levie 指出,AI 代理(AI Agent)的大规模落地正在催生对 FDE(Forward-Deployed Engineer,前置部署工程师)的空前需求。关键在于 AI 代理不是传统软件,它没有既定工作流,部署过程中充满非确定性;与此同时,部署公司 Duet 的数据显示,其产…

ChatGPT Plus用户在每周用量额度耗尽后,可以支付8美元立即重置额度,不必再等待约5小时的自动恢复。这是OpenAI在小范围测试的付费功能,也是其在AI编程工具竞争中的一次商业化探索。

xAI 推出 Grok Bot 测试版,为每个 AI 智能体配一台云端专属电脑,让它们像员工一样独立处理多步骤任务。它不单独售卖,而是捆绑进 Cursor Ultra、Premium Teams 和 SuperGrok Heavy 三档现有订阅,被视为 AI 从“聊天工具”走向“数字打工人”的一次明确商业化尝…

谷歌在 Google I/O 上海大会上宣布,Gemma 4 系列模型全球下载量正式突破 3 亿次。这款以推理能力和智能体工作流为卖点的开源模型系列,在发布后四个多月里成为开发者生态中增长最快的模型家族之一。

DeepSeek 为“Harness 团队”注册了官方公众号,首次为这一业务线建立对外沟通渠道,被普遍视为通用 Agent 产品即将发布的前置动作。这意味着 DeepSeek 正在把大模型能力从“能对话”推进到“能干活”的工程化落地阶段。

字节跳动正式成立新的 AI 一级部门,由王颖雷(Adam Wang)带队,专门负责大模型的数据建设与数据安全,与 Seed、Flow、抖音等部门平级。这标志着字节将大模型的数据底座从“支持角色”提升为战略级配置。

前阿里通义千问负责人林俊旸正式官宣创业,在上海成立 AI 实验室 Pragmatik Labs(中文名:驭言科技),聚焦“数字与物理世界”通用智能体(Agent)。本轮融资由高榕资本和红杉中国(HSG)联合领投,腾讯参投,市场报道称融资金额达数亿美元、估值约 20 亿美元。

游戏开发商 Saber Interactive 深陷“AI 顶替编剧”争议,前首席编剧公开指控公司用 ChatGPT 替换人类编剧,CEO 则全盘否认。真正让事件发酵的原因,不是 AI 本身,而是 Steam 页面全无披露——在玩家对生成式 AI 接受度分裂的当下,透明性已成为比技术本身更敏感的话题。