Cue AI

桌面语音助手 Cue 将文本润色模型从云端切换到本地部署的 Gemma 4 E4B,实现了延迟降低 44%、核心功能使用量提升 30% 的效果,同时让边际推理成本归零。这款产品的技术路线调整让语音交互从“看起来快”变成了“感觉上比打字更快”。

桌面语音助手 Cue 将文本润色模型从云端切换到本地部署的 Gemma 4 E4B,实现了延迟降低 44%、核心功能使用量提升 30% 的效果,同时让边际推理成本归零。这款产品的技术路线调整让语音交互从“看起来快”变成了“感觉上比打字更快”。

开源工具 llmfit 发布了一个新功能,允许用户在自己的硬件上实测大模型的真实推理速度(tok/s),并将结果提交回社区。这意味着“这台机器跑得动哪个模型”将从估算变成可验证的真实数据,对选择本地模型和算力配置有直接参考价值。

据日经新闻研究报告,五大美国科技巨头(苹果、微软、Alphabet、亚马逊、Meta)的隐性债务在过去四年激增八倍,达到 1.65 万亿美元,远超其公开披露的有息负债水平。这笔巨额债务主要来自数据中心租赁和 GPU 供应合同,对投资者评估公司真实财务状况构成重大障碍。

Pollen Robotics 联合 Hugging Face 发布了 Grabette,一个低成本、开源的手持式机器人操作数据采集系统。它让普通人无需拥有机器人或专业实验室,就能用手柄+摄像头录制操作演示,并自动生成可用于训练机器人的完整数据集,目标是构建一个开放协作的大规模操作数据集。

NVIDIA 推出 Cosmos 3 Edge,一个 4B 参数的开源世界模型,专为边缘设备设计,能够在本地执行推理并直接生成机器人动作序列,降低了机器人开发对云端算力的依赖。

小米发布了用于机器人的AI基础模型 Xiaomi-Robotics-1,研究发现,在机器人运动控制领域,增加训练数据量比单纯扩大模型参数更能提升性能。为了构建超大规模数据集,团队大规模采用手持夹爪代替实体机器人进行数据采集。

昆仑万维于7月19日在2026世界人工智能大会上正式发布并开源新一代可交互世界模型 Matrix-Game 3.5。该模型通过多项技术创新解决了长期记忆丢失、视角混乱等世界模型的核心顽疾,并宣布全部核心架构开源,旨在推动世界模型从少数企业的“专利”变为行业共享的基础设施。

阿里于7月21日发布第三代图像生成基座模型Qwen-Image-3.0,将文本输入长度提升至4.5K Token,支持一次性生成含公式、几何图形、多层UI界面的复杂图文内容,并原生支持12种语言和20余种字体。

小鹏汽车于2026年7月21日发布TuringViT视觉编码器,通过架构重构和数据治理,在仅使用约十分之一训练数据(0.85B图文对)的情况下,于ImageNet-1K等六个零样本分类基准上平均准确率达83.6%,超越基于10B数据训练的SigLIP2-L等主流开源模型,核心解决了视觉大模型训练成本高、数据依…

中国电信自研的5G无线网络规划大模型已完成实地验证,将基站选址、覆盖预测、方案生成等环节全面交给AI,规划效率提升50%,方案准确率超过75%。这标志着运营商从“人工经验选站”正式转向“模型驱动建网”,重构了通信基建的底层逻辑。