浙江大学软件学院教授周经森博士确认出席AICon深圳,将分享人工智能时代的性能工程

浙江大学软件学院教授周经森博士将出席AICon深圳站并发表主题演讲,聚焦“AI与性能工程”的双向赋能。值得关注的原因是:大模型竞赛的焦点正在从“模型能力”转向“系统效率”,性能优化已经成为AI规模化落地绕不开的环节。

浙江大学软件学院教授周经森博士将出席AICon深圳站并发表主题演讲,聚焦“AI与性能工程”的双向赋能。值得关注的原因是:大模型竞赛的焦点正在从“模型能力”转向“系统效率”,性能优化已经成为AI规模化落地绕不开的环节。

阿里发布新一代基座大模型 Qwen3.8,总参数达 2.4 万亿,在编程和智能体任务上大幅提升,API 已上线且定价对标 Claude Opus 5 更具性价比。旗舰模型下周开源,值得关注。

华尔街日报报道,美国开放权重AI模型创业公司(如Arcee、Reflection AI、Poolside)正在获得关注,但风投机构正在重新审视它们的商业模式,质疑这些公司能否在开源与闭源模型的夹缝中建立可持续的收入。开放权重不等于免费,但如何让企业客户为“可自部署的模型”持续付费,仍是未解的问题。

北京 AGI Bar 推出“消费即送 AI 算力”玩法,顾客在店内消费后连接 Wi-Fi,就能免费获得 DeepSeek V4 Flash 的无限量 API 使用权。这件事值得关注,因为它把过去需要注册、付费才能使用的 AI 推理能力,变成了线下空间里像 Wi-Fi 一样随手可得的基础服务。

长三角(嘉兴)Token运营中心正式启动,企业可通过统一平台调用DeepSeek、阿里千问等100多个大模型。这是AI算力从资源租赁走向标准化运营的一个信号,值得关注。

阿里被曝正在内测一款名为“万有无界”的 AI 办公平台,核心特点是多个数字员工可以组队协作完成任务。它值得关注的原因在于:办公软件的竞争正在从“单个 AI 助手”走向“多智能体协作”,而阿里这次可能是在国内大厂中率先落地的产品化尝试。

据台湾媒体引述的市场分析报告,谷歌计划到 2028 年部署 1200 万至 1500 万颗自研 TPU v9 芯片,规模有望超过英伟达同期的 AI GPU 出货量。这意味着谷歌正从“租用英伟达算力”转向“自建算力基础设施”,可能对英伟达的 AI 芯片主导地位构成实质挑战。

阿里巴巴发布新一代大模型 Qwen3.8-Max,重点优化真实办公、编程与复杂任务自主执行能力,并宣布下周开源模型权重。大模型竞争正从“跑分”转向智能体在真实场景中的交付能力。

Palantir 联合基础设施公司 Armada,把搭载 Nvidia B300 AI 加速器的数据中心装进标准集装箱,部署到战场边缘。这套系统不依赖稳定云连接即可处理情报,意味着 AI 算力正在从集中式云端走向真正的前线场景。

Hacker News 上围绕“AI 狂热是否又是一场郁金香/加密泡沫”展开激烈争论,其中焦点之一是大模型算力是否真的由加密矿工转移而来,并牵连出对 AI 应用实际付费价值的讨论。