从餐饮后厨到物理世界基础模型:量化派的物理AI,走的是卖能力的路

量化派正在将机器人从“按程序动作”升级为“自主完成任务”,通过在真实餐饮后厨完成四轮技术验证,走了一条不卖硬件、不卖解决方案,而是卖“物理世界基础模型”能力层的商业化路线。这一方向已被 Physical Intelligence、Skild AI 等海外公司用高估值验证,但量化派选择了更复杂的生活场景作为切入…

量化派正在将机器人从“按程序动作”升级为“自主完成任务”,通过在真实餐饮后厨完成四轮技术验证,走了一条不卖硬件、不卖解决方案,而是卖“物理世界基础模型”能力层的商业化路线。这一方向已被 Physical Intelligence、Skild AI 等海外公司用高估值验证,但量化派选择了更复杂的生活场景作为切入…

Runway 平台正式上架 Seedream 5.0 Pro 模型,支持从文本或参考图像生成高细节图片,内嵌文字可在14种语言中清晰呈现。这意味着 AI 图像生成在跨语言排版和多内容呈现上迈出了一步,对电商、广告、教育等需要精准文字展示的创作者尤为实用。

随着高考录取启动,千问高考助手宣布接入中国邮政EMS,上线录取通知书物流实时追踪与主动提醒功能,将AI助手从志愿填报延伸至录取环节,进一步验证大模型在垂直场景中的工具化落地能力。

小米宣布重组其 AI 技术团队,将自研的 MiMo 基础大模型从“可选模型”升级为覆盖手机、汽车、智能家居等所有业务的底层核心技术,目标是解决不同终端 AI 能力碎片化问题,打造无缝的智能生态系统。这一调整显示小米正在将 AI 从产品功能定位提升为整个公司的基础设施。

Robbyant 发布了 LingBot-VLA 2.0,一个拥有 60 亿参数的开源视觉-语言-动作(VLA)模型,能让不同型号的机器人通过自然语言指令和视觉输入执行复杂操作任务。这一进展将缩小通用 AI 研究与实体机器人部署之间的差距。

谷歌在相册应用中推出AI驱动的“视频混音”功能,基于其Gemini Omni模型,用户只需选择素材和音乐,即可在数秒内自动生成具备转场、节奏剪辑和调色的短视频,目标直指零门槛的电影级视频创作。

腾讯混元 Hy3 模型在办公智能代理工具 WorkBuddy 上线后,因用户调用量远超预期导致算力峰值承压,项目团队已紧急完成算力扩容。此次事件反映出市场对国产高性能大模型办公工具的强劲需求,也再次验证了大模型落地中“推理算力”环节的敏感性。

AI 大模型独角兽智谱于 2026 年 7 月 9 日宣布完成约 314 亿港元(约合 40 亿美元)的配售融资,资金将重点投向基础模型研发、算力基础设施建设及全球生态拓展。这笔融资是当前大模型赛道中规模较大的单笔资本市场操作之一,表明智谱正为新一轮技术竞赛储备弹药。

2026年7月8日,Cloudflare与OpenAI正式启动一项深度研究试点,核心目标是利用Cloudflare全球网络中的实时数据信号(如网页更新频率、流量趋势和变化轨迹)来提升AI搜索引擎的内容索引精度和实时性。这意味着AI搜索将不再完全依赖传统爬虫,而是能更动态地捕捉互联网上最新、最活跃的信息流。

HubSpot 在 2026 年 7 月 1 日更新服务条款,被用户发现可能擅自抓取 CRM 中的联系人与商业数据用于“商业数据集”,引发大规模信任危机。四天后,公司宣布完全撤回该条款,并承诺未来所有数据增强功能将严格以“透明 Opt-in”方式提供。