小鹏这次把智驾模型搞成了“时间机器”
智驾系统如果只盯着眼前这一帧画面,那它永远只是个“反应迟钝”的机器,而不是真正的司机。小鹏在最近的物理 AI 分享会上展示的第二代 VLA 模型(版本 6.3.0),核心逻辑其实就在解决一个问题:如何让车拥有对“时间”的感知。
为了让这个大模型能跑在量产车上,小鹏把参数量扩大了 3.5 倍,并且针对单图灵芯片的 Max 车型做了 Lite 版的蒸馏处理,预计 9 月就会开始推送。
下一篇
奇瑞风云 T7 这次定价确实有点不讲武德 →
现在的智驾逻辑大多是“看到什么做什么”,但老司机开车是靠记忆和预判的。小鹏这次给模型加了三个维度的“时间感”:
- 回溯过去: 通过 Infini-VLA 架构,模型现在能记住过去 30 秒的路况。这非常关键,比如前车正在做掉头动作,模型不是只看到前方有个空位就直接冲过去,而是能结合之前的动作轨迹,判断出对方还没完成掉头,从而做出更拟人的等待决策。
- 理解当下: 引入了 Streaming Inference(流式自回归推理),决策速度直接提升了 300%。这意味着模型不需要等一整段历史数据处理完才动作,而是像人眼看路、大脑判断、手脚操作那样并行处理,减少了推理带来的延迟。
- 预判未来: 利用 X-Foresight 和 Flow Matching 技术,模型能对未来 6 秒的轨迹进行推演。面对对面逆向行驶的车辆,它不再是单纯的“避让”,而是会预判对方是想停下还是想挤过去,从而决定自己是加速通过还是减速避让。
为了让这个大模型能跑在量产车上,小鹏把参数量扩大了 3.5 倍,并且针对单图灵芯片的 Max 车型做了 Lite 版的蒸馏处理,预计 9 月就会开始推送。

说实话,现在的车企都在往“具身智能”或者“物理 AI”这个概念上靠,本质上是因为单纯卷硬件、卷配置已经没利润了,只有把汽车变成一个能在复杂物理世界里自主决策的“大机器人”,技术壁垒才会高。小鹏这次展示的轮渡码头自动行驶、狭窄山路避让悬空树枝等场景,确实比单纯跑高速巡航要硬核得多。
不过,这种“时间感”带来的防御性驾驶到底能不能在各种极端 corner case 下稳住,还得看 9 月大规模推送后的真实路测表现。
免费 AI 工具箱 · 全部完全免费
