AI硬件
小鹏发布TuringViT视觉基座,统一智驾座舱机器人感知
发布时间:2026年07月23日 16:00:00小鹏发布TuringViT视觉基座,采用线性注意力技术将高分辨率计算近线性化,供智驾、座舱、机器人三业务线共用,试图打破视觉大模型头部专属成本墙。
发布背景
小鹏汽车正式发布TuringViT视觉基座,这是一款面向多业务线的统一视觉大模型。
技术亮点
线性注意力
TuringViT采用线性注意力(TLA)技术,将高分辨率图像计算复杂度从二次方降为近线性,大幅降低计算成本。
统一架构
一个视觉基座供智驾、座舱、机器人三业务线共用,实现技术复用和协同优化。
高分辨率处理
能够处理高分辨率图像,提升感知精度和细节识别能力。
业务应用
智能驾驶
为自动驾驶系统提供高精度视觉感知,支持复杂场景识别和决策。
智能座舱
实现座舱内的乘客监测、手势识别等功能,提升交互体验。
机器人感知
为小鹏的机器人业务提供视觉感知能力,支持自主导航和避障。
成本优势
打破成本墙
通过线性注意力和统一架构,小鹏试图打破视觉大模型"头部专属"的成本壁垒,让更多企业能够使用先进视觉技术。
规模化效益
三业务线共用一个视觉基座,通过规模化降低单位成本。
技术普惠
降低视觉大模型的使用门槛,推动智能汽车和机器人行业的技术普及。
行业影响
视觉技术革新
线性注意力技术可能成为视觉大模型的主流方向,改变传统Transformer架构的计算方式。
垂直整合
小鹏通过自研视觉基座,实现从感知到决策的全链路自主可控。
竞争格局
视觉技术的突破可能改变智能汽车行业的竞争格局,推动技术创新。
未来展望
TuringViT的发布标志着小鹏在AI技术领域的深度布局,为其智能汽车和机器人业务奠定坚实基础。