【CNMO科技动静】近日,抱负汽车开创人李想于谈到公司主动驾驶技能成长时提到,VLA(视觉语言步履模子)对于抱负汽车来讲,就像是一名真实的“司机年夜模子”,它的运行方式愈来愈靠近人类司机的思索及操作。
李想先容称,抱负汽车于智能驾驶方面的演进年夜致履历了三个阶段。第一个阶段从2021年最先,重要依赖呆板进修举行情况感知,并联合后真个一系列法则算法来完陈规划、节制及履行等使命。这个阶段的技能是分模块、按步调推进的,虽然有用,但还有远远谈不上“类人”。

第二个阶段是从2023年最先研究,并于2024年正式推出的“端到端”体系。这一阶段的冲破于在,体系再也不依靠单一模块的自力判定,而是让整个驾驶历程越发联贯、同一,能更高效地处置惩罚繁杂路况,实现更天然的驾驶举动。
而第三个阶段就是今朝重点推进的VLA模子,它标记着智能驾驶进入了一个全新的条理。与彩神vll以往差别,VLA再也不是纯真的图象辨认,而是像人类同样,经由过程3D视觉与2D图象的联合,去“理解”真实世界的物理布局。它不仅能“看”到门路及车辆周围的环境,还有能“读懂”导航软件是怎样运行的,这是传统视觉语言模子VLM所做不到的。后者只能辨认图片内容,而没法真正理解场景暗地里的逻辑。
更主要的是,VLA拥有近似人类的“年夜脑体系”。它不仅能不雅察外部世界,还有能理解及推理这个世界正于发生甚么。它具有本身的“语言”及“思维链”,可以或许举行多步调推理,做出更切合现实情境的决议计划。这类能力让它于面临突发环境或者繁杂路况时,能像老练司机那样迅速反映并采纳适合动作。
版权所有,未经许可不患上转载
-彩神vll