蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-Flash

蚂蚁百灵于7月24日发布原生混合推理模型Ling-3.0-Flash,总参数124B但每次推理仅激活5.1B,在多项核心指标上匹配或超越参数规模2-3倍的行业领先模型,已上线OpenRouter免费试用一周,随后将开源。

蚂蚁百灵于7月24日发布原生混合推理模型Ling-3.0-Flash,总参数124B但每次推理仅激活5.1B,在多项核心指标上匹配或超越参数规模2-3倍的行业领先模型,已上线OpenRouter免费试用一周,随后将开源。

美团官方否认了旗下大模型LongCat负责人裴鹏离职的传言,同时其万亿参数模型LongCat-2.0已实现全流程国产算力训练与推理,这既体现了团队稳定性,也意味着国产算力在大模型落地方向上取得实质性进展。

腾讯将经典QQ宠物以3D形态重生,并内置自研Hy3大模型(295亿参数,MoE架构),使宠物具备主动回应和个性化交互能力。这不仅是情怀复活,更是一次将大模型嵌入高频C端场景的落地尝试。

AMD 在 7 月 23 日的 Advancing AI 2026 大会上发布了 Instinct MI455X 加速器和 Helios 机架系统,首次将 2nm 制程引入 GPU 计算芯粒,并获得了 OpenAI、Meta、微软等关键客户的公开站台。这标志着 AMD 正式开始从“卖单卡”转向交付“机架级 A…

昆仑万维集中发布 Matrix-3.5 世界模型、Mureka V9.5/O3 音乐模型和 Riemann-1.0 机器人世界模型,明确了世界模型的两条落地路径:虚拟内容实时生成与交互,以及机器人先预测再行动。CEO 方汉将 2026 年称为“世界模型元年”,这一判断背后是模型从“生成画面”向“理解因果和持续…

AI 数据工具公司 Encord 与德国神经科学初创公司 Zander Labs 合作,在机器人训练过程中收集操作员的脑电波信号,试图用“意图”和“误差”等高阶信号弥补物理世界训练数据极度稀缺的短板。这不再是数据管理生意,而是直接制造训练数据的尝试。

开发者卡兹克开源了名为 Leader.skill 的工具,专门帮助用户把模糊的“领导式需求”转化为可执行的 Agent 目标任务书。它基于“目标七问”方法论,强调约束比目标本身更重要,旨在解决长程 Agent 因目标不清而浪费大量 Token(案例中单次浪费 20 亿 Token)的问题。

苹果智能眼镜(代号N50)预计将在2027年WWDC亮相、同年秋季发售,核心差异化卖点是隐私保护——苹果可能采用无摄像头只保留AI交互的方案,或强制禁用拍照录像,并通过边缘AI处理避免用户数据上传。这一策略与Meta等竞品形成鲜明对比,有望重塑AI可穿戴设备的信任基线。

英伟达与韩国互联网巨头Naver联合投资10亿美元(约67.78亿人民币),将现有的DSX AI工厂从当前规模扩建至200兆瓦,并引入Brookfield资产管理公司提供最高90亿美元的资金支持。这是英伟达在亚太地区AI算力布局的又一重要动作,旨在服务韩国及美国AI创新企业的训练与推理需求。

月之暗面(Moonshot AI)为旗舰模型Kimi K3举办庆功会,现场标语明确指向下一代模型K4的研发。这显示其在算力与长文本能力上的投入正在加快,行业竞争已从发布新品转向连续迭代。