马斯克:Grok 4.8 本周完成训练,参数量冲到 2.5 万亿,全新 C++ 软件栈喂出来

马斯克在 X 平台透露,xAI 的 Grok 4.8 将在本周完成训练,参数量达到 2.5 万亿,并使用一套全新的 C++ 软件栈。这一规模意味着 xAI 正把筹码压在超大参数模型上,同时试图用底层工程优化换取训练效率。

马斯克在 X 平台透露,xAI 的 Grok 4.8 将在本周完成训练,参数量达到 2.5 万亿,并使用一套全新的 C++ 软件栈。这一规模意味着 xAI 正把筹码压在超大参数模型上,同时试图用底层工程优化换取训练效率。

豆包手机助手消费者版正式发布,首次把「操作手机」的 GUI 自动化能力以 Beta 形式开放,并推出 SAEP 协议,让第三方 App 可以自主声明是否允许 AI 在自己界面内执行自动化操作。

有爆料称 DeepSeek 即将推出代号 Code 2.0 的新模型,参数规模或超 3 万亿,主打 Computer Use 能力,性能目标直指 Mythos 5.1 和 GPT-6 Astra。若属实,这将是国内参数规模最大的大模型之一。

开源 AI 编码工具 OpenCode 旗下的 10 美元月费订阅服务 OpenCode Go,已连续两周实现收支平衡。在多数 AI 编码工具仍靠烧钱或卖数据维持的背景下,这意味着低价订阅加开源模型组合,存在走通商业闭环的可能。

智谱于9月13日晚宣布完成约50亿美元新融资,资金将主要投向下一代GLM基础模型、全自训练系统和算力基础设施。其核心目标是把"下一代GLM由上一代GLM训练"变成可运行的递归自我改进循环。

苹果计划今年秋季低调推出新一代 Apple TV,跳过发布会直接上线官网,核心变化是换上支持端侧大模型的新芯片,让 Siri 从机械搜索升级为能理解复杂自然语言的助手。

月之暗面于2026年9月12日上线主力模型K2.8 Preview,已在Kimi Code和Kimi Work全量推送,官方称综合性能接近旗舰K3,编程与Agent能力提升明显,并支持1M超长上下文且向全部会员开放。

据 AIbase 报道,DeepSeek 在发布 V4.1Flash 之后,业内传闻其将于 9 月推出参数规模超过 3 万亿的 DeepSeek Code2.0,主打“电脑控制”能力,性能目标直指前沿闭源模型。目前这些信息尚未获得官方完整确认。

AIbase 报道称,vLLM-Omni 架构与 FastVideo 的 FastH3 推理方案,让 MiniMax H3 视频大模型在八卡 B300 上做到“生成时间短于播放时长”的准实时服务,端到端延迟相比 Diffusers 下降 30.8%。

Anthropic 与 Rum Group 签下为期六年、金额 137 亿美元的算力采购协议,为 Claude 系列产品补充基础设施;Rum Group 出身社交媒体领域,且与特朗普政府关系密切,这意味着 Anthropic 的算力供应商名单里又多了一家带政治背景的公司。