小鹏这次把智驾模型搞成了“时间机器”

PromptCube 专家 1小时前 221 浏览 8 点赞 约 2 分钟

智驾系统如果只盯着眼前这一帧画面,那它永远只是个“反应迟钝”的机器,而不是真正的司机。小鹏在最近的物理 AI 分享会上展示的第二代 VLA 模型(版本 6.3.0),核心逻辑其实就在解决一个问题:如何让车拥有对“时间”的感知。

现在的智驾逻辑大多是“看到什么做什么”,但老司机开车是靠记忆和预判的。小鹏这次给模型加了三个维度的“时间感”:

  • 回溯过去: 通过 Infini-VLA 架构,模型现在能记住过去 30 秒的路况。这非常关键,比如前车正在做掉头动作,模型不是只看到前方有个空位就直接冲过去,而是能结合之前的动作轨迹,判断出对方还没完成掉头,从而做出更拟人的等待决策。
  • 理解当下: 引入了 Streaming Inference(流式自回归推理),决策速度直接提升了 300%。这意味着模型不需要等一整段历史数据处理完才动作,而是像人眼看路、大脑判断、手脚操作那样并行处理,减少了推理带来的延迟。
  • 预判未来: 利用 X-Foresight 和 Flow Matching 技术,模型能对未来 6 秒的轨迹进行推演。面对对面逆向行驶的车辆,它不再是单纯的“避让”,而是会预判对方是想停下还是想挤过去,从而决定自己是加速通过还是减速避让。
小鹏这次把智驾模型搞成了“时间机器”

为了让这个大模型能跑在量产车上,小鹏把参数量扩大了 3.5 倍,并且针对单图灵芯片的 Max 车型做了 Lite 版的蒸馏处理,预计 9 月就会开始推送。

小鹏这次把智驾模型搞成了“时间机器”

说实话,现在的车企都在往“具身智能”或者“物理 AI”这个概念上靠,本质上是因为单纯卷硬件、卷配置已经没利润了,只有把汽车变成一个能在复杂物理世界里自主决策的“大机器人”,技术壁垒才会高。小鹏这次展示的轮渡码头自动行驶、狭窄山路避让悬空树枝等场景,确实比单纯跑高速巡航要硬核得多。

不过,这种“时间感”带来的防御性驾驶到底能不能在各种极端 corner case 下稳住,还得看 9 月大规模推送后的真实路测表现。

小鹏VLA智驾物理AI

全部回复 (3)

T
Tom 中级 1小时前
确实,以前过弯总觉得生硬,现在这版本变道感觉顺滑多了。
0 回复
副业中测试 中级 1小时前
以前遇到加塞车总反应不过来,现在看它能预判提前减速,确实像个老司机。
0 回复
独立开发者Leo 专家 1小时前
这个VLA模型对遮挡物预测准不准啊?上次过路口盲区总怕出事。
0 回复

发表回复

支持 Markdown 格式