AI资讯

小鹏G9L升级AI大模型,让自动驾驶真正理解时间,开车更聪明

智能摘要

传统的模型虽然能识别车辆和行人,但车辆需要知道过去、现在以及未来可能发生什么。模型能够做到“边看、边想、边行动”的并行处理,面对前车突然刹停、行人折返或旁车强行加塞等突发情况时,反应如同老司机般娴熟敏捷。

小鹏此次摒弃虚浮不实之举, 径直促使AI学会领会“时间”。第二代VLA大模型于8月27号发布, 迎来首次意义重大的升级, XOS6.3.0版本会于G9L上率先发布。这并非仅仅是版本的更新, 而是底层能力实现的质的跃升所带来的。

对于传统智驾系统而言, 仅能够看懂处于静止状态的画面, 然而新模型却可以将之前30秒时间内呈现出来的道路情况进行记忆留存, 进而形成具有连续性的一组记忆链接。这所蕴含的意义在于, 该系统并非像之前那样一帧一帧地去加以处理信息, 而是如同经验丰富的老司机一般拥有了那种被称之为“时间感”的能力。

从3D到4D的理解革命

小鹏G9L升级AI大模型,让自动驾驶真正理解时间,开车更聪明

在过去的一些年份当中, 自动驾驶这个行业始终都在针对“感知能力”展开讨论, 然而, 绝大多数种类的方案截至目前都仅仅暂停留在静态的3D空间理解这一层面之上。小鹏所推出的第二代VLA成功达成了从3D朝着4D的跨越之举, 将时间这个维度也拉入到理解的范畴之内。这可以说是一个具备基础性的突破。

新的车机系统引进了-VLA长时序架构, 这个架构可以记住前30秒当中发生的全部道路事情, 车辆不会再孤立应对前车刹车或者行人横穿等突发状况, 而是把这些突发情况串联成连续场面来展开判定, 这样一来决策就会更加连贯且稳定。

3.5倍参数量拉开差距

在同样价位的车型大多都采用小型模型的这种形势背景之下, 小鹏却直接把端侧模型之内的参数量给扩大到了原本的3.5倍, 就这个参数量级之间所呈现出的差距而言, 这意味着智驾系统所具备的泛化能力以及面对复杂场景时的应对能力将会得到显著的提升。

能够使模型处理更多维度信息、从而面对陌生路况的识别拥有更高准确率, 基于更大的参数体量达成, 配合具备超长时序的内容记录功能, 车辆驾驶中的系统确实实现了驾驶辅助体系中“看得比较准, 思想过程有逻辑, 作出回应比较迅速”的体验效果。

反应速度提升300%

另一个关键之处在于推理效率的提升, 第二代VLA运用流式自回归推理架构, 从离散推理转变为连续推理模式, 端至端的响应速度加快至原本的四倍, 显著减轻了从发觉意识到执行的时长。

这种具备并行处理能力的情况, 使得车辆得以达成一边观看、一边思考、一边实施行动的状态。当着前面的车辆突然紧急刹车、行人中途折返或者旁边的车辆进行加塞等这些突发急剧情况出现的时候, 系统作出的反应更为灵敏快捷, 近乎达到人类经验丰富的老司机的处理水准。

L4级技术下放量产车

最新版本, 在车机座舱首次引入了, 整车大脑Agent, 达成了VLA与VLM的驾舱融合。系统在一方面, 不但能够理解自然与模糊语义, 另一方面, 还可以把 用户意图, 自动拆解成任务, 调度智驾、底盘、座舱等模块, 协同地执行。

新增的新版具备语音靠边停车这一功能, 同时还有语音控制就近泊入的功能呢, 它完成了从发出语音指令到能够自主执行这样一个完整的闭环。小鹏正在把部分源自L4级的同源技术下放到量产车型当中, 从而让更多的用户能够享受到高阶智驾的体验。

人形机器人同步推进

被小鹏视作同一技术底座不同应用本体的, 是汽车与机器人。通用人形机器人IRON所搭载的3颗图灵AI芯片, 使得它算力强大。其已实现的是端侧部署并且能够自主去完成复杂工作任务。

小鹏的机器人业务, 在近期完成了, 超9亿美元的首轮股权融资, 投后估值超过了, 63亿美元。与此同时, 搭载第二代VLA的测试车辆, 已经获得了, 广州智能网联汽车远程测试资质, 能够在相关道路, 开展主驾无安全员测试。

相关文章