小鹏第二代VLA大模型迎来首次重大升级,综合安全能力暴增20倍

小鹏第二代VLA大模型完成首次重大升级,通过引入时间理解能力和超大参数架构,将车辆综合安全能力提升20倍,并首次将L4级Robotaxi的部分能力下放到量产车。

一句话看懂:小鹏第二代VLA大模型完成首次重大升级,通过引入时间理解能力和超大参数架构,将车辆综合安全能力提升20倍,并首次将L4级Robotaxi的部分能力下放到量产车。

事件核心:发生了什么

8月27日,小鹏集团举行以“TIME-时间”为主题的AI分享活动,宣布第二代VLA大模型首次重大升级,新版本XOS 6.3.0在小鹏G9L上全球首发。此次升级的核心是从静态3D空间认知转向动态4D时空理解:模型通过Infini-VLA长时间序列架构能够记住过去30秒的世界状态,并采用流式自回归推理将端到端响应速度提升300%,实现“看见、思考、行动”的并行处理。

在硬件与架构层面,边缘侧模型参数量提升3.5倍,首次在车端部署X-Foresight预测世界模型,可预先模拟未来6秒内周边交通参与者的行为。新引入的MoT混合架构能按任务动态分配模型能力,减少城市、园区、停车等不同场景间的任务干扰。综合多维度的升级,官方宣称安全能力提升20倍。此外,小鹏首次推出车机Master Agent,将VLA与VLM在座舱内融合,支持“语音控车泊车”等功能,实现从语音指令到自主执行的闭环。

为什么重要

这次升级的意义在于验证了自动驾驶领域的Scaling Law并非停留在参数堆砌,而是向时间维度延伸。过去VLA模型处理的是离散的图像帧,无法理解“前车可能在3秒后变道”这类动态推理;小鹏将时序上下文和流式推理引入车端模型,实际上是把物理AI的基础范式从“空间识别”推进到“时空预测”。此举也为行业划定了一条新的技术分水岭——L4级Robotaxi与量产车的技术差距正在被压缩,小鹏近期获批广州智能网联汽车远程测试资格,无人驾驶测试车的技术积累开始反哺乘用车。

在商业层面,小鹏机器人业务刚完成9亿美元首轮股权融资,投后估值超过63亿美元,此次VLA升级同时覆盖车与机器人,显示出统一技术底座、摊薄研发成本的策略意图。

对用户/开发者/创作者的影响

对普通车主而言,最直接的感知是智驾系统面对加塞、前车急刹、行人折返等突发场景时,决策更接近老司机,且“语音控制停车”等新交互降低了学习成本。对开发者而言,小鹏计划在9月通过G9L Max版本首发蒸馏后的Turing VLA2.0 Lite模型,这意味着低算力平台也能调用VLA能力——目前公开信息显示,该项技术通过基于学习的Token压缩与蒸馏训练实现,为第三方开发者或车企提供了在更低硬件成本上接入高阶智驾能力的路径。对内容创作者和AI应用开发者来说,VLA模型理解自然语言和模糊语义的能力,可能催生车载场景下的新应用生态,例如基于车辆感知数据的自动化内容生成。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

一是蒸馏版Turing VLA2.0 Lite在G9L Max上的实际表现能否保持安全能力不缩水,这决定了该技术能否向中低端车型普及。二是小鹏机器人IRON搭载三颗图灵AI芯片、算力2250 TOPS并实现边缘部署,其与车端VLA的协同效果尚未有公开实测数据,值得跟踪。三是竞品跟进速度——华为、理想、特斯拉等均在布局端到端大模型,小鹏此次在时间序列架构上的先发优势能维持多久,将影响下一阶段智驾竞争格局。

来源:AIbase

celebrityanime
celebrityanime
文章: 20751

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注