小鹏第二代VLA大模型迎来首次重大升级 AI开始真正理解时间
开车时遇到低头看手机的行人慢慢靠近斑马线,传统智驾要等他迈出步子才紧急刹车,而老司机会提前松油门备刹——这种靠经验积累出的“时间感”,现在AI也学会了。

8月27日小鹏以“TIME 时间”为主题举办物理AI分享会,第二代VLA大模型迎来首次重大升级。这不是一次常规的功能叠加,而是智能驾驶的底层范式跃迁:AI第一次把“时间”纳入理解维度,从静态的“3D空间识别”正式迈入动态的“4D时空认知”,综合安全能力提升20倍,开车的体验越来越像经验丰富的老司机。
读懂“时间”的AI,开车到底强在哪?
很多人会疑惑:不就是模型升级,至于上升到“时空认知”的高度?其实只要想明白一个道理:真实的马路从来不是一张张静止的照片,而是连续流动的过程。危险往往藏在变化里:前车微微偏移可能要加塞,行人脚步犹豫可能要横穿,只看懂“当下这一帧”的AI,永远慢半拍。

这次升级的核心,就是给AI补上了完整的“时间轴”,靠三套技术形成了“记忆过去-处理现在-预判未来”的决策闭环。
记住过去:30秒超长上下文,开车不再“断片”
过去的智驾模型更像“看图答题”,每帧画面单独判断,前因后果连不上。比如旁边车道的车慢慢贴过来,它要等车轮压线了才识别出“加塞”,然后猛踩刹车,乘客体验很差。

新一代Infini-VLA长时序架构,让模型能记住前30秒的完整路况。这就像新手司机只盯着车头前几米,老司机脑子里装着半分钟的车流变化。有了连续的上下文,AI能提前识别车辆的偏移趋势、行人的动向变化,预判更准,减速更缓,不会再一惊一乍。
反应更快:提速300%,边看边想边行动
道路情况不会等AI算完再变化。传统模型是“看清楚→算方案→输出动作→再看下一帧”的串行流程,遇到突发情况总要有个“反应延迟”。

第二代VLA改用流式自回归推理,把串行改成了并行,端到端响应速度直接提升300%。通俗说就是:眼睛还在观察路况,大脑已经在同步思考,执行机构同步做出动作。遇到前车急刹、行人突然折返,车辆的反应像人类司机一样自然流畅,不再有“愣一下再刹车”的生硬感。
预判未来:提前6秒推演,走一步想三步
真正的老司机厉害在“预判”,而不是“反应快”。开车不是只有一个正确答案,同一个路口,行人可能走也可能停,前车可能加速也可能减速,能提前想到多种可能性,才能选出最安全平顺的方案。

小鹏首次上车的X-Foresight预测世界模型,能推演未来6秒内周边车辆、行人的运动轨迹,还引入Flow Matching技术,不再只给出一个死板的结果,而是预测多种可能的走向,再从中选最优路径。比如看到绿灯倒计时,它会提前判断能不能顺畅通过,不会到停止线前才急刹;看到路边行人驻足,会提前松油门备刹,留足安全余量。
这三套能力加起来,AI开车就从“机械执行规则”变成了“像人一样思考判断”,这也是综合安全性能提升20倍的核心原因。
不止智驾:整车有了“统一大脑”
这次升级的惊喜不止于开得更稳。小鹏还用做机器人的思路重构了车机,首次推出Master Agent整车大脑,让车辆从“听懂指令”进化到“理解意图”。

以前的车机更像“语音遥控器”,你得准确说出“打开空调24度”“导航到XX大厦”,差一个字都可能识别错。现在有了Master Agent,它能听懂你的真实想法:你说“去望京那栋三个尖的楼”,它能匹配到正确的目的地;你说“回公司顺路买杯咖啡再寄个快递”,它会自动拆解任务、规划路线,不用你一步步指挥。

更实在的是Robotaxi的L4级能力开始下放量产车:语音靠边停车、语音就近泊车。智驾状态下只要说一句“靠边停”,车辆就能自己找合适的位置停稳,不用你手动打方向、踩刹车。相当于把无人驾驶出租车的体验,直接搬进了家用车。
真正的野心:一套AI底座,打通汽车和机器人
很多人没意识到,这次模型升级真正的分量,远不止一款车的智驾更新。小鹏反复强调自己是“物理AI公司”,而不是普通车企——这套第二代VLA是通用的物理世界基座模型,意思是:同一个AI大脑,能装在不同的“身体”里。

在汽车领域,它已经实现了从L2辅助驾驶到L4级Robotaxi的能力贯通。目前搭载这套模型的小鹏Robotaxi,已经在广州拿到主驾无安全员的测试资质,内测完成超过2000单,开始进入真实道路验证阶段。

在机器人领域,这套能力同样在落地。小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力达2250 TOPS,靠这套基座模型就能在端侧自主运行,不用远程遥控就能完成复杂任务。就在发布会前三天,小鹏机器人业务完成首轮超9亿美元融资,投后估值超63亿美元,刷新中国具身智能行业单轮融资纪录,IDG、高榕领投,腾讯、阿里巴巴都参与了战略投资。

资本看好的,正是这套“一个技术底座,复用在多个本体”的模式。汽车是第一个规模化落地的载体,用来积累数据、打磨模型,再把能力迁移到机器人、飞行汽车等更多领域,形成正向循环。

同时这套模型也在走向全球。小鹏在德国完成了第二代VLA的本地化测试,几乎不用额外增加训练数据,就能适配欧洲的道路环境。目标明年上半年拿到欧洲监管许可,把中国的智能驾驶能力送到全球市场。
科技普惠:好技术不只是顶配专属
再好的技术,只有少数人用就没有规模效应。小鹏这次同时带来了图灵VLA 2.0 Lite蒸馏版,预计9月开启首批推送,小鹏G9L Max版本首发搭载。

简单说,模型蒸馏就是把大模型的能力,压缩到算力更低的硬件平台上。物理AI的蒸馏比普通大模型难度高得多,小鹏跑通了这条路径,意味着先进的智驾能力不用只靠顶配硬件支撑,更多车型、更多老车主也能用上。

对用户来说,感知到的变化很直接:复杂路口判断更果断,不会反复犹豫;变道、绕行、转弯更自然,没有生硬的顿挫;整体体验更稳定,开车时不用一直紧绷着神经“监督”系统。
结语

从“看见空间”到“读懂时间”,看似只是多了一个维度,背后却是智能驾驶的底层逻辑之变。当AI不再被动响应路况,而是主动记忆、实时思考、提前预判,它才真正开始像人类一样理解物理世界。

而这还只是小鹏物理AI战略的一步。背后支撑这一切的,是小鹏花了几年搭建的完整AI基础设施:百万级车队贡献真实路况数据,单次训练数据吞吐量达1亿clips,比半年前增长10倍,形成了“数据越多→模型越强→场景越多→数据更多”的飞轮效应。

当模型的进化不再依赖单点突破,而是靠完整的体系持续迭代,物理AI的复利才真正开始显现。未来这套能力能延伸到哪里,答案远不止于汽车。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

叶卡捷琳娜二世
校验提示文案
考神附体
校验提示文案
大宽
校验提示文案
中号硬核玩家
校验提示文案
隔壁的七大叔
校验提示文案
我是小猫猫
校验提示文案
著名有钱妞
校验提示文案
有点丑的蛋蛋
校验提示文案
蓝里个蓝
校验提示文案
小树熊
校验提示文案
zhoulong3303
校验提示文案
zhoulong3303
校验提示文案
小树熊
校验提示文案
我是小猫猫
校验提示文案
蓝里个蓝
校验提示文案
有点丑的蛋蛋
校验提示文案
隔壁的七大叔
校验提示文案
中号硬核玩家
校验提示文案
大宽
校验提示文案
考神附体
校验提示文案
著名有钱妞
校验提示文案
叶卡捷琳娜二世
校验提示文案