Ling 3.0 Flash 是同尺寸中最智能的开源模型。

蚂蚁集团旗下 inclusionAI 于 8 月 13 日发布开源模型 Ling 3.0 Flash,在同尺寸开源模型中拿下最高智能评分,同时把 API 价格压到同类最低水平,让小模型低成本落地 Agent 任务变得更现实。

蚂蚁集团旗下 inclusionAI 于 8 月 13 日发布开源模型 Ling 3.0 Flash,在同尺寸开源模型中拿下最高智能评分,同时把 API 价格压到同类最低水平,让小模型低成本落地 Agent 任务变得更现实。

英伟达联合Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR六家机构,计划为AI数据中心建设投入最高5000亿美元;同时用自己的钱为抵押的GPU提供部分价值担保,为老旧芯片建立二手市场。这既是为了给算力扩张找新资金来源,也是一场高风险的下注。

阿里系开源大模型 Qwen3.8-2.4T-A95B 发布,硅基流动当天就上线了可用的推理服务。这标志着超大参数 MoE 模型从权重开放到部署落地的时间差被大幅压缩,开发者可以立刻通过 API 调用,而不是必须先凑齐万卡级算力。

芝加哥商品交易所(CME)将于10月5日推出追踪Nvidia GPU小时租金的期货合约,算力首次拥有公开透明的参考价格。这是AI算力从私下议价走向标准化商品交易的关键一步。

域名交易平台 Escrow.com 最新数据显示,.ai 域名平均成交价达到 53.5 万美元,三个月内飙升 260%,首次超过 .com 的 52.9 万美元。AI 热潮正在从模型层传导到品牌资产层面,重塑域名市场的价值排序。

CoreWeave、Nebius 等 AI 基础设施公司发布超预期财报,显示出算力需求依然坚挺,暂时打消了市场对“AI 资本开支见顶”的担忧。这为重仓 AI 交易的投资者争取到了一个观察窗口:即将发布的英伟达财报将成为下一块试金石。

Qencode 将其视频编码 API 通过 MCP(Model Context Protocol)协议对外开放,这意味着 AI 模型和智能体可以直接调用视频转码、压缩与处理能力,视频处理正从“人工调用接口”进入“AI 自动调度”的早期阶段。

Oracle 计划在 8 月再裁一批员工,部分团队裁员比例达两位数;与此同时,其上一财年资本开支飙升至约 557 亿美元,靠大规模举债建设 AI 数据中心。这是 AI 资本开支挤压人力成本的典型案例。

亚马逊、谷歌、Meta、微软等巨头今年将在AI基础设施上合计投入超过5000亿美元,但真正的成本大头可能不是训练模型,而是模型日常运行时的“推理”开销。业界正在用“Tokenomics”(代币经济)重新审视AI的真实账单。

2026 年 8 月 12 日,Peter Yang 在 X 上发文称,电脑交互方式将迎来根本性变化——人们会从“手动操作”转向“语音指挥云端 Agent”,并认为语音将成为新的软件编排层。这个判断值得关注,因为它指向 AI Agent 替代传统软件界面的路径。