微软收紧员工 AI 预算:有人 28 天烧掉 2.8 万美元,编程转向 GPT-5.6 Sol

微软因内部AI调用成本失控,开始严查员工Token消耗,并将默认编程工作负载切换至自研GPT-5.6 Sol。此事折射出大模型在规模化落地中,推理成本正成为企业最实际的经营压力。

微软因内部AI调用成本失控,开始严查员工Token消耗,并将默认编程工作负载切换至自研GPT-5.6 Sol。此事折射出大模型在规模化落地中,推理成本正成为企业最实际的经营压力。

国内首部 AIGC 长剧《后西游记》于 8 月 31 日开播,采用“边审边播”模式,首次将 AI 生成内容以长剧形式推向卫视黄金档,是 AIGC 从短片走向长视频工业化的一次关键试水。

中国信通院最新MCP专项测试中,上海原点星光研发的27B参数本地模型StartLux-V1.0-27B-Preview综合成绩超越DeepSeek-V4-Flash,并以不到其1/10的参数量,在部分任务上追平了1.6T参数的DeepSeek-V4-Pro。这件事值得关注,因为它意味着“参数竞赛”正在被“本地…

华为与上海交大医学院附属瑞金医院联合发布瑞智病理大模型 RuiPath 2.0,并宣布已在超 90 家医院落地应用。这次升级的重点不是常规病种,而是对常见肿瘤罕见亚型的识别能力补强。

腾讯混元旗舰模型 Hy4preview 上线即遇调用高峰,因 Agent 能力显著增强导致算力排队,腾讯紧急扩容推理集群。这件事说明高性能推理算力已成为大模型落地复杂任务时的现实瓶颈。

阿里通义千问上线了 Agent Teams 功能,把 AI 视频创作从“写提示词”升级为“多智能体协作”——用户只提想法,编剧、导演、美术等 AI 角色自动分工执行,并同步推出了 Wan3.0 视频生成模型。

开源智能体项目 OpenClaw 发布 2.0 版本,重构底层架构并推出“共享云端会话”功能,让团队能多人协同操作同一个 AI 工作流,而不再局限于单机或个人会话。

OpenAI 内部代号为“Bel”的新一代大模型已完成预训练,参数量达到 10 万亿级别。这是继“Doug”之后的下一个基础模型,直接瞄准 AGI 能力边界,也意味着 OpenAI 在模型规模和自研算力两个维度上同时提速。

Glassdoor 最新数据显示,美国员工对 AI 的好评率从 2019 年的 81% 滑落至 2026 年年中的 43%,负面评价反超至 53%。当技术热情遭遇落地压力,职场对生成式 AI 的态度已从“尝鲜”转向“审视”。

Anthropic 宣布从 9 月 14 日起将 Claude Code 付费版基础周用量永久上调 25%,但因同期临时加量政策到期,用户实际可用的每周额度反而比现在低 17%。这是一次典型的算力资源再平衡,也反映出 AI 编程工具正从规模扩张转向精细化运营。