小鹏第二代VLA大模型迎来首次重大升级 AI开始真正理解时间
开车时遇到低头看手机的行人慢慢靠近斑马线,传统智驾要等他迈出步子才紧急刹车,而老司机会提前松油门备刹——这种靠经验积累出的“时间感”,现在AI也学会了。

8月27日小鹏以“TIME 时间”为主题举办物理AI分享会,第二代VLA大模型迎来首次重大升级。这不是一次常规的功能叠加,而是智能驾驶的底层范式跃迁:AI第一次把“时间”纳入理解维度,从静态的“3D空间识别”正式迈入动态的“4D时空认知”,综合安全能力提升20倍,开车的体验越来越像经验丰富的老司机。
读懂“时间”的AI,开车到底强在哪?
很多人会疑惑:不就是模型升级,至于上升到“时空认知”的高度?其实只要想明白一个道理:真实的马路从来不是一张张静止的照片,而是连续流动的过程。危险往往藏在变化里:前车微微偏移可能要加塞,行人脚步犹豫可能要横穿,只看懂“当下这一帧”的AI,永远慢半拍。

这次升级的核心,就是给AI补上了完整的“时间轴”,靠三套技术形成了“记忆过去-处理现在-预判未来”的决策闭环。
记住过去:30秒超长上下文,开车不再“断片”
过去的智驾模型更像“看图答题”,每帧画面单独判断,前因后果连不上。比如旁边车道的车慢慢贴过来,它要等车轮压线了才识别出“加塞”,然后猛踩刹车,乘客体验很差。

新一代Infini-VLA长时序架构,让模型能记住前30秒的完整路况。这就像新手司机只盯着车头前几米,老司机脑子里装着半分钟的车流变化。有了连续的上下文,AI能提前识别车辆的偏移趋势、行人的动向变化,预判更准,减速更缓,不会再一惊一乍。
反应更快:提速300%,边看边想边行动
道路情况不会等AI算完再变化。传统模型是“看清楚→算方案→输出动作→再看下一帧”的串行流程,遇到突发情况总要有个“反应延迟”。

第二代VLA改用流式自回归推理,把串行改成了并行,端到端响应速度直接提升300%。通俗说就是:眼睛还在观察路况,大脑已经在同步思考,执行机构同步做出动作。遇到前车急刹、行人突然折返,车辆的反应像人类司机一样自然流畅,不再有“愣一下再刹车”的生硬感。
预判未来:提前6秒推演,走一步想三步
真正的老司机厉害在“预判”,而不是“反应快”。开车不是只有一个正确答案,同一个路口,行人可能走也可能停,前车可能加速也可能减速,能提前想到多种可能性,才能选出最安全平顺的方案。

小鹏首次上车的X-Foresight预测世界模型,能推演未来6秒内周边车辆、行人的运动轨迹,还引入Flow Matching技术,不再只给出一个死板的结果,而是预测多种可能的走向,再从中选最优路径。比如看到绿灯倒计时,它会提前判断能不能顺畅通过,不会到停止线前才急刹;看到路边行人驻足,会提前松油门备刹,留足安全余量。
这三套能力加起来,AI开车就从“机械执行规则”变成了“像人一样思考判断”,这也是综合安全性能提升20倍的核心原因。
不止智驾:整车有了“统一大脑”
这次升级的惊喜不止于开得更稳。小鹏还用做机器人的思路重构了车机,首次推出Master Agent整车大脑,让车辆从“听懂指令”进化到“理解意图”。

以前的车机更像“语音遥控器”,你得准确说出“打开空调24度”“导航到XX大厦”,差一个字都可能识别错。现在有了Master Agent,它能听懂你的真实想法:你说“去望京那栋三个尖的楼”,它能匹配到正确的目的地;你说“回公司顺路买杯咖啡再寄个快递”,它会自动拆解任务、规划路线,不用你一步步指挥。

更实在的是Robotaxi的L4级能力开始下放量产车:语音靠边停车、语音就近泊车。智驾状态下只要说一句“靠边停”,车辆就能自己找合适的位置停稳,不用你手动打方向、踩刹车。相当于把无人驾驶出租车的体验,直接搬进了家用车。
真正的野心:一套AI底座,打通汽车和机器人
很多人没意识到,这次模型升级真正的分量,远不止一款车的智驾更新。小鹏反复强调自己是“物理AI公司”,而不是普通车企——这套第二代VLA是通用的物理世界基座模型,意思是:同一个AI大脑,能装在不同的“身体”里。

在汽车领域,它已经实现了从L2辅助驾驶到L4级Robotaxi的能力贯通。目前搭载这套模型的小鹏Robotaxi,已经在广州拿到主驾无安全员的测试资质,内测完成超过2000单,开始进入真实道路验证阶段。

在机器人领域,这套能力同样在落地。小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力达2250 TOPS,靠这套基座模型就能在端侧自主运行,不用远程遥控就能完成复杂任务。就在发布会前三天,小鹏机器人业务完成首轮超9亿美元融资,投后估值超63亿美元,刷新中国具身智能行业单轮融资纪录,IDG、高榕领投,腾讯、阿里巴巴都参与了战略投资。

资本看好的,正是这套“一个技术底座,复用在多个本体”的模式。汽车是第一个规模化落地的载体,用来积累数据、打磨模型,再把能力迁移到机器人、飞行汽车等更多领域,形成正向循环。

同时这套模型也在走向全球。小鹏在德国完成了第二代VLA的本地化测试,几乎不用额外增加训练数据,就能适配欧洲的道路环境。目标明年上半年拿到欧洲监管许可,把中国的智能驾驶能力送到全球市场。
科技普惠:好技术不只是顶配专属
再好的技术,只有少数人用就没有规模效应。小鹏这次同时带来了图灵VLA 2.0 Lite蒸馏版,预计9月开启首批推送,小鹏G9L Max版本首发搭载。

简单说,模型蒸馏就是把大模型的能力,压缩到算力更低的硬件平台上。物理AI的蒸馏比普通大模型难度高得多,小鹏跑通了这条路径,意味着先进的智驾能力不用只靠顶配硬件支撑,更多车型、更多老车主也能用上。

对用户来说,感知到的变化很直接:复杂路口判断更果断,不会反复犹豫;变道、绕行、转弯更自然,没有生硬的顿挫;整体体验更稳定,开车时不用一直紧绷着神经“监督”系统。
结语

从“看见空间”到“读懂时间”,看似只是多了一个维度,背后却是智能驾驶的底层逻辑之变。当AI不再被动响应路况,而是主动记忆、实时思考、提前预判,它才真正开始像人类一样理解物理世界。

而这还只是小鹏物理AI战略的一步。背后支撑这一切的,是小鹏花了几年搭建的完整AI基础设施:百万级车队贡献真实路况数据,单次训练数据吞吐量达1亿clips,比半年前增长10倍,形成了“数据越多→模型越强→场景越多→数据更多”的飞轮效应。

当模型的进化不再依赖单点突破,而是靠完整的体系持续迭代,物理AI的复利才真正开始显现。未来这套能力能延伸到哪里,答案远不止于汽车。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

叶卡捷琳娜二世
校验提示文案
考神附体
校验提示文案
大宽
校验提示文案
著名有钱妞
校验提示文案
大宽
校验提示文案
考神附体
校验提示文案
著名有钱妞
校验提示文案
叶卡捷琳娜二世
校验提示文案