世界模型、预测模型之后的AI路在何方?小鹏给出的答案是:TuringViT 热闻

封面新闻记者 李继龙

在智能驾驶竞争不断升级的背景下,车企之间的较量正从应用层逐渐向底层AI能力延伸。

近日,小鹏汽车发布视觉基础模型TuringViT。这是继世界模型、预测模型等技术之后,小鹏今年推出的又一项AI底层技术成果。与过去更多聚焦具体功能不同,此次发布瞄准的是视觉感知这一智能驾驶和具身智能的重要基础能力,也意味着车企对于AI竞争正进一步深入到底层技术领域。


(资料图片仅供参考)

视觉感知被认为是智能驾驶系统获取环境信息的重要入口。随着大模型、VLA(视觉-语言-动作)等技术加速落地,行业对视觉模型提出了更高要求,包括处理更高分辨率图像、多摄像头输入以及连续视频数据,同时还要兼顾算力和运行效率。

零样本性能、训练数据规模以及VisionTransformer编码器的1K分辨率吞吐量。TuringViT仅使用10%的训练数据,就实现了比领先的开源基线模型更强的准确性与效率权衡。

据小鹏介绍,TuringViT围绕模型架构、数据治理和训练方式进行了优化。官方数据显示,该模型仅使用约10%的训练数据,便达到甚至超过部分主流开源视觉模型的性能,同时在高分辨率场景下具备更高运行效率。

对于智能汽车而言,这意味着车辆能够以更低算力成本完成更复杂的环境感知,从而进一步提升辅助驾驶系统在复杂路况、狭窄道路、特殊交通参与者识别等场景下的表现。与此同时,也有望降低智能驾驶系统开发和部署成本。

TuringViT的块架构和模型配置。 (左)主干建立在重复的图灵块,图灵线性注意力(TLA)聚合全局上下文;其序列长度感知归一化和输入依赖的输出门可稳定可变标记训练并保持高频局部细节。 (右)TuringViT-18L和TuringViT-24L的模型配置,在共享相同补丁大小(16×16)的同时,采用2D RoPE,以块和总层数为尺度,嵌入/头部维度,以及多层感知器(MLP)比例。

值得关注的是,这项技术并不仅局限于汽车。按照官方规划,TuringViT未来将同时应用于智能驾驶、智能座舱以及IRON人形机器人,成为小鹏物理AI体系的重要视觉基础平台。

今年以来,随着AI大模型快速发展,国内多家车企纷纷加快布局AI底层能力。从世界模型到端到端智能驾驶,再到如今的视觉基础模型,行业竞争重点正从单一功能比拼,逐渐转向算法、数据和算力等核心能力建设。

业内普遍认为,未来智能汽车竞争不仅取决于硬件配置,更取决于底层AI模型的持续迭代能力。谁能够构建更高效、更低成本、更易训练的基础模型,谁就有望在智能驾驶、智能座舱乃至具身智能等多个领域形成更大的技术优势。

随着AI技术不断向汽车产业渗透,车企之间的竞争也正在从产品竞争升级为底层技术体系竞争,而视觉大模型正成为这一轮竞争的重要方向之一。

关键词: 算法 视觉 预测 世界模型 智能驾驶业务

推荐DIY文章
世界模型、预测模型之后的AI路在何方?小鹏给出的答案是:TuringViT 热闻
热消息:黑历史曝光!女友加西亚:亚马尔若不是百万富翁,根本不会有人正眼瞧他
7月22日科创新能源ETF易方达基金份额增加600万份,重仓股海博思创、微导纳米、嘉元科技
美股异动|GE Vernova跌超7%,风电业务持续拖累整体盈利表现 今日观点
让技术扎根产业沃土——天津“两新融合”展现新图景 焦点短讯
奥浦迈:上半年净利润同比预增229%左右
当前热议!广州洹宇科技有限公司成立 注册资本1万人民币
精彩看点:宏昌科技:融资净偿还233.98万元,融资余额1.24亿元
德永佳集团(00321.HK)获执行董事潘彬泽增持31.4万股 热闻
A股:紧急提醒2.5亿股民!从明天7月22日起,A股可能再次历史重演?-快讯
恒力石化(600346.SH):首次回购1104.41万股公司股份
从三蹦子到比亚迪!中国车在佛得角火了 当地华商:国货认可度太高了
快消息!算力租赁概念表现活跃 中嘉博创5天3板
阿根廷主帅泪洒发布会:我不知能否再进决赛,39岁的梅西是最好的
每日视点!西班牙夺冠!能让想到去年北京国安塞蒂恩吗
美银证券:升创科实业(00669)目标价至141.6港元 看好Milwaukee品牌发展 每日讯息
【聚看点】WAIC系列 | 摩尔线程董龙飞谈超节点:未来竞争不只是拼GPU,更是拼工程化能力
今日热议:适当放松,沙尔克组织全队在训练营休息期间观看世界杯
尼科-威廉斯:这一年我挺倒霉,这是我人生中最开心的一天
全红婵成都看黄子韬演唱会!暴瘦后白净纤细很娇小,2万LV包吸睛|信息
米体:贡萨洛14岁弟弟洛伦索崭露头角,场上被称小内马尔