在 NVIDIA GB300 NVL72 上,以可配置推理服务 Qwen3.8-2.4T-A95B(2.4T 参数模型)。

阿里开源了2.4万亿参数的Qwen3.8-2.4T-A95B(Qwen3.8-Max),NVIDIA随即展示了它在GB300 NVL72机架级系统上的推理表现:不微调即可实现每GPU每秒超4000 token的吞吐。这是目前开源界参数规模最大的模型之一,值得关注的不只是“大”,而是混合注意力+细粒度MoE架构…

阿里开源了2.4万亿参数的Qwen3.8-2.4T-A95B(Qwen3.8-Max),NVIDIA随即展示了它在GB300 NVL72机架级系统上的推理表现:不微调即可实现每GPU每秒超4000 token的吞吐。这是目前开源界参数规模最大的模型之一,值得关注的不只是“大”,而是混合注意力+细粒度MoE架构…

微软 AI 部门在 2026 年 8 月 12 日发布了首款自研推理模型 MAI-Thinking-1,该模型从零训练,而非基于第三方开源模型微调,目前已在 Microsoft Foundry 开放试用。这件事值得关注,因为它表明微软开始具备独立于 OpenAI 的自研大模型能力。

AI2 旗下地球观测平台 OlmoEarth Studio 上线了 embedding 导出功能,用户能基于开源 OlmoEarth 模型,对指定卫星影像区域计算并下载自定义向量数据,直接用于相似性搜索、土地分类等下游分析。这是遥感基础模型从“跑模型”走向“可复用数据资产”的一步。

德国一个维权组织对 Meta 的 AI 眼镜提起刑事诉讼,理由是这款产品外观与普通墨镜难以区分,可能构成法律意义上的“伪装式偷录设备”。这起诉讼触及智能眼镜最核心的合规命门:摄像头指示灯亮着,但路人真的知道它在录吗?

欧洲AI编程创企Lovable完成4亿美元C轮融资,估值达到133亿美元。这家公司用“边聊边写代码”的方式快速获得收入增长,不到一年估值翻倍,说明资本市场对AI应用层的态度正从观望转向重注。

谷歌在最新发布的 Pixel 11 系列中,把 Gemini AI 放进了相机流程:既能替你“看着”画面自动抓拍,也能用更快的夜景算法减少糊片。手机影像的竞争重点,正从镜片和传感器,转向端侧 AI 对拍摄过程的接管。

LiquidAI 于 8 月 12 日发布 30 亿参数的视觉语言模型 LFM2.5-VL-3B,在屏幕理解、目标定位、函数调用等能力上大幅提升,为端侧本地部署视觉 AI 提供更实用的选择。

Nvidia正在推进新一代开放权重模型Nemotron 4,最大版本参数规模至少达到1万亿,试图追平中国实验室已经率先实现的大模型量级,同时这也让Nvidia站到了自己核心客户的对面。

2026年8月初,OpenAI宣称解决了十个重大数学与理论计算机问题,包括首个非sofic群构造和multicolour Ramsey数超指数增长。但数学家Gowers指出,LLM目前最擅长的是构造反例,而非给出完整证明——这定义了当前AI数学能力的边界。

TechRadar 刊登了 Diagrid 联合创始人 Yaron Schneider 的评论文章:判断 AI Agent 是否值得信任,关键不在演示多成功,而在生产环境中出故障后系统能否自愈——而不是从头重来。