AI硬件

小鹏发布TuringViT视觉基座,统一智驾座舱机器人感知

发布时间:2026年07月23日 16:00:00

小鹏发布TuringViT视觉基座,采用线性注意力技术将高分辨率计算近线性化,供智驾、座舱、机器人三业务线共用,试图打破视觉大模型头部专属成本墙。


发布背景

小鹏汽车正式发布TuringViT视觉基座,这是一款面向多业务线的统一视觉大模型。

技术亮点

线性注意力

TuringViT采用线性注意力(TLA)技术,将高分辨率图像计算复杂度从二次方降为近线性,大幅降低计算成本。

统一架构

一个视觉基座供智驾、座舱、机器人三业务线共用,实现技术复用和协同优化。

高分辨率处理

能够处理高分辨率图像,提升感知精度和细节识别能力。

业务应用

智能驾驶

为自动驾驶系统提供高精度视觉感知,支持复杂场景识别和决策。

智能座舱

实现座舱内的乘客监测、手势识别等功能,提升交互体验。

机器人感知

为小鹏的机器人业务提供视觉感知能力,支持自主导航和避障。

成本优势

打破成本墙

通过线性注意力和统一架构,小鹏试图打破视觉大模型"头部专属"的成本壁垒,让更多企业能够使用先进视觉技术。

规模化效益

三业务线共用一个视觉基座,通过规模化降低单位成本。

技术普惠

降低视觉大模型的使用门槛,推动智能汽车和机器人行业的技术普及。

行业影响

视觉技术革新

线性注意力技术可能成为视觉大模型的主流方向,改变传统Transformer架构的计算方式。

垂直整合

小鹏通过自研视觉基座,实现从感知到决策的全链路自主可控。

竞争格局

视觉技术的突破可能改变智能汽车行业的竞争格局,推动技术创新。

未来展望

TuringViT的发布标志着小鹏在AI技术领域的深度布局,为其智能汽车和机器人业务奠定坚实基础。