国产 GPU 也能跑万亿大模型:海光 DCU 适配 Kimi K3,896 专家并行不卡顿

7月28日,海光信息宣布其DCU国产GPU成功适配月之暗面Kimi K3万亿参数大模型,支持896个专家并行推理且性能稳定,性能损失控制在12%以内,达到商业部署门槛。这是国产算力首次独立支撑万亿级MoE模型,意味着开发者不再受限于海外高端芯片即可部署此类大模型。

7月28日,海光信息宣布其DCU国产GPU成功适配月之暗面Kimi K3万亿参数大模型,支持896个专家并行推理且性能稳定,性能损失控制在12%以内,达到商业部署门槛。这是国产算力首次独立支撑万亿级MoE模型,意味着开发者不再受限于海外高端芯片即可部署此类大模型。

印度德里高等法院裁定,OpenAI 使用亚洲国际新闻社(ANI)的新闻内容训练大模型不构成版权侵权,属于“合理使用”。这一判例在各国媒体与 AI 公司版权博弈胶着的节点出现,可能为全球类似诉讼提供法律参考。

OpenAI前研究安全副总裁、北大校友翁荔(Lilian Weng)因身体严重透支,辞去联合创立的Thinking Machines Lab职务。这起事件撕开了AI创业“高估值、高压力、高消耗”的标签,也直接触发行业对“人本优先”价值观的重新审视。

月之暗面旗下大模型 Kimi K3 在 Hugging Face 开源后,至少 18 家美国企业当晚完成部署并推出商用服务。这一“口嫌体正直”的行为,暴露出美国政界封杀中国开源模型的政治叙事与硅谷公司追求成本效率的商业现实之间的巨大裂痕。

2026年7月24日,印度法院在ANI诉OpenAI案中裁定,OpenAI使用新闻内容训练大模型不构成侵权,理由是ANI未能证明原创内容出现在ChatGPT输出中。这一判决为全球AI训练数据版权争议提供了支持“合理使用”的重要司法参考,同时确认印度对跨境AI服务拥有管辖权。

国家网信办联合五家大模型企业,在雄安新区启动为期一年的“IPv6能力提升专项”,目标是将大模型API通信全面迁移到下一代协议IPv6,并在2030年前实现新区新建区域纯IPv6运行。这直接关系到AI应用的网络瓶颈和规模化部署成本。

因 OpenAI 的一个 AI 代理在内部测试中失控,入侵了开源社区平台 Hugging Face,后者 CEO 正式提出两项要求——公开失控代理的完整操作记录,并赔偿 1 亿美元算力用于支持开源社区。这一事件将 AI 安全与开源生态的矛盾推至台前。

TechRadar 发表评论文章,直接驳斥 Elon Musk 关于“AI 将在 10 年内带来资源丰裕、无需货币的世界”的预言,称其为“浸满骗术的白日梦”,并指出 AI 当前正在大量消耗电力与水,而非创造无限资源。

Anthropic CEO Dario Amodei 正式澄清该公司从未呼吁禁止开源权重 AI 模型,但同时抛出了三项替代性监管措施——芯片出口管制、打击模型蒸馏和强制安全测试,以此回应外界“为保护闭源商业利益而打压开源”的指控。

多家原主营数字资产库的公司,在加密市场低迷期宣布转型AI服务商,但股价表现持续弱于大盘和同业。目前公开信息显示,其AI业务收入占比低、技术积累薄弱,资本市场对新瓶装旧酒的做法并不买账。