头像
鹏友1082618
09-08 14:13
开小鹏看世界:当AI拥有了“时间感”

曾几何时,当我们谈论智能驾驶时,脑海中浮现的往往是车辆如何精准地“看见”眼前的车道线、行人和红绿灯。然而,真实的世界从来不是一张张静止的幻灯片,而是一部连续不断、充满未知的长镜头电影。这一次,小鹏第二代VLA大模型迎来首次重大升级,用一场以“TIME 时间”为主题的物理AI分享会告诉我们:真正的智驾,不仅要“看见”,更要“理解时间”。

从“看图”到“看剧”:AI终于拥有了记忆与预判

传统模型在面对复杂路况时,往往只能基于当下的单帧画面做出反应,这种“看一帧、算一帧”的离散处理模式,难免会在面对突发状况时显得机械甚至迟钝。而小鹏第二代VLA的这次跃迁,核心就在于将AI的认知维度从静态的3D空间推向了动态的4D时空。

这得益于全新引入的Infini-VLA长时序架构。它让车辆拥有了“记忆”,能够记住前30秒的世界。这意味着,连续发生的道路事件不再被割裂成孤立的碎片。当你在路口遇到前车犹豫不决时,系统不再是单纯地判断它此刻的位置,而是能结合它30秒前的减速、打灯等动作,串联起完整的时序逻辑,从容地做出等待或超车的决策。

更令人惊叹的是它的“预判”能力。首次上车的X-Foresight预测世界模型,能够根据目标物的位置、速度和运动趋势,推演未来6秒内可能发生什么。无论是前车突然刹停,还是行人临时折返,系统都能提前预判并规划出最优解。从“被动反应”到“主动预见”,小鹏让AI真正拥有了类似老司机的“时间感”。

边看边想边行动:毫秒级的从容应对

理解了时间,还需要足够快的反应速度。面对瞬息万变的真实道路,如果决策速度跟不上现实变化,再好的预判也无济于事。第二代VLA采用了Streaming Inference(流式自回归推理)技术,彻底颠覆了传统“看→算→输出→再看”的串行模式,实现了“边看、边想、边行动”的并行处理。

这一底层逻辑的改变,让端到端响应速度飙升了300%。在广州这样路况极其复杂的城市实测中,当一位怀抱孩童的母亲毫无征兆地从盲区跑步横穿道路时,系统没有选择机械的一脚急刹,而是统合了自车速度和行人的运动趋势,做出了平稳减速的应对。这不仅保障了安全,更兼顾了车内乘客的舒适体感。这种带着“活人感”的从容,正是4D时空智能在真实世界中最生动的体现。

走向全球:用大算力构筑泛化壁垒

为了让这套“时空智能”能够走向全球,小鹏在底层架构上投入了巨大的算力。全新XOS 6.3.0版本的端侧模型参数量扩大了3.5倍,达到了业内主流VLA模型的15倍以上。配合MoT混合架构,系统能够针对城区、园区、泊车等不同场景动态分配模型能力,将复杂问题交给不同的“专家”处理。

这种大参数量的底气,直接转化为多维综合安全能力20倍的提升。不仅如此,这套基于中国海量数据训练的模型,展现出了极强的泛化能力。在德国完成的本地化验收测试中,它在几乎不增加当地训练数据的情况下,依然保持了与国内高度接近的驾驶体验。目前,小鹏已计划于2027年上半年在欧洲取得监管许可,让全球用户都能体验到这份“中国智造”。

结语:探索一条更难但更酷的路

从小鹏第二代VLA的这次升级中,我们看到的不仅是一次技术的迭代,更是一种造车理念的升维。正如小鹏汽车高管所言,与其做一个亦步亦趋的“追赶者”,不如成为一名探索未知的“探索者”。

当AI开始理解时间,当智能驾驶从“极客尝鲜”走向“大众常用”,小鹏正在用有温度的科技,重新定义我们看世界的方式。开着小鹏看世界,我们看到的不再只是冰冷的机器和代码,而是一个能够记住过去、理解现在、预判未来的智能伙伴,正带着我们从容地驶向更广的未来。
ai可能包含AI生成内容
最新评论
暂无评论