特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

特斯拉世界模拟器来了!

这些看似真实的驾驶场景,全都是用模拟器生成:

这个模拟器在今年的计算机视觉顶会 ICCV 上亮相,由特斯拉自动驾驶副总裁 Ashok Elluswamy 亲自讲解。

网友看了之后表示,这个模型实在是泰裤辣。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

同时,Elluswamy 也首次揭秘了特斯拉的自动驾驶技术路线图,表示端到端才是智能驾驶的未来。

世界模拟器生成自动驾驶场景

除了开头看到的多场景驾驶视频,特斯拉的世界模拟器还可以为自动驾驶任务生成新的挑战场景。

比如右侧的车辆突然连并两条线,闯入预设的驾驶路径。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

也可以让 AI 在已有的场景中执行自动驾驶任务,躲避行人和障碍物。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

模型生成的场景视频,除了让自动驾驶模型在里面练手,也可以当成电子游戏,供人类玩耍体验。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

当然除了驾驶相关,对其他具身智能场景——比如特斯拉的擎天柱机器人——也同样有用。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

与这个模型一同被揭秘的,还有特斯拉在自动驾驶上的一整套方法论。

特斯拉 VP:端到端才是自动驾驶的未来

ICCV 演讲中,特斯拉自动驾驶副总裁 Ashok Elluswamy 揭秘了特斯拉 FSD 的技术细节,同时还在 X 上发表了文字版本。

Ashok 首先明确,端到端 AI 才是自动驾驶的未来。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

特斯拉利用端到端神经网络实现自动驾驶,这个端到端神经网络会利用来自各个摄像头的图像、运动信号(例如车速)、音频、地图等数据,生成驱动汽车的控制指令。

与端到端相对的另一种方法是采用大量传感器的模块化驾驶,这类系统的优势是在初期更容易开发和调试,但相比之下,端到端的优势更加明显:

将人类价值观规则化极其困难,但从数据中学习则容易;

模块化方法中感知、预测和规划之间的接口定义不明确,但在端到端中梯度从控制一直流向传感器输入,从而整体优化整个网络;

端到端方法可轻松扩展以处理现实世界机器人的繁重和长尾问题;

端到端具有确定性延迟的同质计算。

Ashok 举了一些例子,比如车辆行驶过程中发现前方路面存在积水,此时有两种策略,一是直接从积水上开过,二是借用对向车道绕过积水。

驶入对向车道是危险的,但在这个具体场景中视野开阔,在避开水坑所需的路程之内对向车道没有车辆,借用对向车道避开水坑是一种可行的选择。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

这种权衡取舍就很难用传统的编程逻辑来表达,而对于人类来说,这在观察场景时却相当简单。

基于以上考虑及其他因素,特斯拉采用了端到端的自动驾驶架构,当然,端到端系统也仍有许多挑战需要克服。

特斯拉如何解决端到端自动驾驶困难

端到端自动驾驶面临的困难,其中之一就是评估。特斯拉推出的世界模拟器,也正是针对这一难题。

该模拟器使用特斯拉筛选出的同样的海量数据集进行训练,其功能并非预测给定状态下的行动,而是根据当前状态和下一步行动来合成未来状态。

这样的状态可以与智能体或策略 AI 模型连接起来,以闭环方式运行,从而评估性能。

同时,这些视频并不局限于评估,它还可以用于闭环大规模强化学习,从而实现超越人类的表现。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

除了评估之外,端到端自动驾驶还面临 ” 维数灾难 “,以及可解释性和安全性保证的问题。

在现实世界中,想让自动驾驶系统安全运行,就需要处理高帧率、高分辨率、长上下文输入。

假设输入信息包括 7 个摄像头 × 36FPS × 5 百万像素 × 30 秒的场景画面、未来几英里的导航地图和路线、100Hz 的运动数据,以及 48KHz 的音频数据,大约会有 20 亿输入 Token。

神经网络需要学习正确的因果映射,将这 20 亿个 Token 精简为 2 个,即车辆的下一个转向和加速动作。在不学习虚假相关性的情况下学习正确的因果关系是一个极其棘手的问题。

为此,特斯拉通过庞大的车队,每天收集相当于 500 年驾驶总和的数据,并使用复杂的数据引擎筛选最高质量的数据样本。

使用这样的数据进行训练,就能让模型获得极高的泛化能力,从而应对极端情况。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

对于可解释和安全性问题,如果车辆的行为不符合预期,端到端系统的调试可能就会变得很困难,但模型也可以生成可解释的中间 Token,可以根据情况用作推理 Token。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

特斯拉的生成式高斯泼溅就是这样一项任务,它具有出色的泛化能力,无需初始化即可建模动态物体,并可与端到端模型联合训练。

其中所有的高斯函数都是基于量产车配置的摄像头生成的。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

除了 3D 几何之外,推理还可以通过自然语言和视频背景进行。该推理模型的一个小版本已经在 FSD v14.x 版本中运行。

 特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线

更多技术细节,可以到 Ashok 的文章和原始演讲视频当中一探究竟。

端到端自动驾驶两大路线:VLA 还是世界模型?

虽然端到端被视为自动驾驶的未来,但在业界,具体的软件算法路线也一直存在 VLA 和世界模型之争。

以国内为例,华为蔚来都是世界模型路线的代表,元戎启行和理想则选择 VLA 路线,另外也有一些玩家认为应该将两者结合。

VLA 玩家认为,该范式一方面可以应用互联网已有的海量数据,积累丰富常识,进而理解世界。另一方面模型通过语言能力实际上是具备了思维链能力,能够理解长时序数据并进行推理。

更尖锐的观点认为,有些厂家不用 VLA 是因为算力不够,带不动 VLA 模型。

世界模型玩家们则坚持世界模型更接近问题本质,例如华为车 BU CEO 靳玉志认为 “VLA 这样的路径看似取巧,并不能真正走向自动驾驶 “。

而现在,特斯拉的方案之所以备受关注,也正是因为在自动驾驶发展历程中,马斯克从未有过 ” 选错 “。

特斯拉选什么路线,VLA 还是世界模型,关于端到端自动驾驶两大技术路线的历史性决战。

你看好 VLA,还是世界模型?

参考链接:

[ 1 ] https://x.com/Tesla/status/1982255564974641628

[ 2 ] https://x.com/aelluswamy/status/1981644831790379245

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法!

— 完 —

年度科技风向标「2025 人工智能年度榜单」评选报名火热进行中!我们正在寻找 AI+ 时代领航者 点击了解详情

企业、产品、人物 3 大维度,共设立了 5 类奖项,欢迎企业报名参与

一键关注 点亮星标

科技前沿进展每日见

以上就是特斯拉世界模拟器亮相 ICCV!VP 亲自解密端到端自动驾驶技术路线的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/102924.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2025年11月21日 11:30:30
下一篇 2025年11月21日 11:48:50

相关推荐

  • 怎样用免费工具美化PPT_免费美化PPT的实用方法分享

    利用KIMI智能助手可免费将PPT美化为科技感风格,但需核对文字准确性;2. 天工AI擅长优化内容结构,提升逻辑性,适合高质量内容需求;3. SlidesAI支持语音输入与自动排版,操作便捷,利于紧急场景;4. Prezo提供多种模板,自动生成图文并茂幻灯片,适合学生与初创团队。 如果您有一份内容完…

    2025年12月6日 软件教程
    100
  • Pages怎么协作编辑同一文档 Pages多人实时协作的流程

    首先启用Pages共享功能,点击右上角共享按钮并选择“添加协作者”,设置为可编辑并生成链接;接着复制链接通过邮件或社交软件发送给成员,确保其使用Apple ID登录iCloud后即可加入编辑;也可直接在共享菜单中输入邮箱地址定向邀请,设定编辑权限后发送;最后在共享面板中管理协作者权限,查看实时在线状…

    2025年12月6日 软件教程
    200
  • 怎么下载安装快手极速版_快手极速版下载安装详细教程

    1、优先通过华为应用市场搜索“快手极速版”,确认开发者为北京快手科技有限公司后安装;2、若应用商店无结果,可访问快手极速版官网下载APK文件,需手动开启浏览器的未知来源安装权限;3、也可选择豌豆荚、应用宝等可信第三方平台下载官方版本,核对安全标识后完成安装。 如果您尝试在手机上安装快手极速版,但无法…

    2025年12月6日 软件教程
    000
  • REDMI K90系列正式发布,售价2599元起!

    10月23日,redmi k90系列正式亮相,推出redmi k90与redmi k90 pro max两款新机。其中,redmi k90搭载骁龙8至尊版处理器、7100mah大电池及100w有线快充等多项旗舰配置,起售价为2599元,官方称其为k系列迄今为止最完整的标准版本。 图源:REDMI红米…

    2025年12月6日 行业动态
    200
  • Linux中如何安装Nginx服务_Linux安装Nginx服务的完整指南

    首先更新系统软件包,然后通过对应包管理器安装Nginx,启动并启用服务,开放防火墙端口,最后验证欢迎页显示以确认安装成功。 在Linux系统中安装Nginx服务是搭建Web服务器的第一步。Nginx以高性能、低资源消耗和良好的并发处理能力著称,广泛用于静态内容服务、反向代理和负载均衡。以下是在主流L…

    2025年12月6日 运维
    000
  • Linux journalctl与systemctl status结合分析

    先看 systemctl status 确认服务状态,再用 journalctl 查看详细日志。例如 nginx 启动失败时,systemctl status 显示 Active: failed,journalctl -u nginx 发现端口 80 被占用,结合两者可快速定位问题根源。 在 Lin…

    2025年12月6日 运维
    100
  • 华为新机发布计划曝光:Pura 90系列或明年4月登场

    近日,有数码博主透露了华为2025年至2026年的新品规划,其中pura 90系列预计在2026年4月发布,有望成为华为新一代影像旗舰。根据路线图,华为将在2025年底至2026年陆续推出mate 80系列、折叠屏新机mate x7系列以及nova 15系列,而pura 90系列则将成为2026年上…

    2025年12月6日 行业动态
    100
  • 2025年双十一买手机选直板机还是选折叠屏?建议看完这篇再做决定

    随着2025年双十一购物节的临近,许多消费者在选购智能手机时都会面临一个共同的问题:是选择传统的直板手机,还是尝试更具科技感的折叠屏设备?其实,这个问题的答案早已在智能手机行业的演进中悄然浮现——如今的手机市场已不再局限于“拼参数、堆配置”的初级竞争,而是迈入了以形态革新驱动用户体验升级的新时代。而…

    2025年12月6日 行业动态
    000
  • 菜鸟app的语音助手怎么唤醒_菜鸟app语音助手使用方法

    检查菜鸟App麦克风及后台运行权限;2. 在App内开启语音助手功能;3. 通过首页麦克风图标手动唤醒;4. 更新App至最新版本以确保功能正常。 如果您在使用菜鸟App时希望快速获取快递信息或执行相关操作,但发现语音助手无法响应,可能是由于唤醒功能未正确设置。以下是解决此问题的步骤: 本文运行环境…

    2025年12月6日 软件教程
    000
  • Linux如何优化系统性能_Linux系统性能优化的实用方法

    优化Linux性能需先监控资源使用,通过top、vmstat等命令分析负载,再调整内核参数如TCP优化与内存交换,结合关闭无用服务、选用合适文件系统与I/O调度器,持续按需调优以提升系统效率。 Linux系统性能优化的核心在于合理配置资源、监控系统状态并及时调整瓶颈环节。通过一系列实用手段,可以显著…

    2025年12月6日 运维
    000
  • 助力工业转型升级金士顿工博会大放异彩

    在刚刚落幕的第二十五届中国国际工业博览会(简称“工博会”)上,参会嘉宾或满载而归,或回味无穷,但无一例外地达成了一项共识——人工智能正深度赋能新型工业化,中国制造业正从“制造”迈向“智造”,并在转型升级之路上取得了令人瞩目的成就。 工业变革的核心在于技术架构的重塑与关键技术的支撑。当现代工业逐步演进…

    2025年12月6日 行业动态
    000
  • 曝小米17 Air正在筹备 超薄机身+2亿像素+eSIM技术?

    近日,手机行业再度掀起超薄机型热潮,三星与苹果已相继推出s25 edge与iphone air等轻薄旗舰,引发市场高度关注。在此趋势下,多家国产厂商被曝正积极布局相关技术,加速抢占这一细分赛道。据业内人士消息,小米的超薄旗舰机型小米17 air已进入筹备阶段。 小米17 Pro 爆料显示,小米正在评…

    2025年12月6日 行业动态
    000
  • 荣耀手表5Pro 10月23日正式开启首销国补优惠价1359.2元起售

    荣耀手表5pro自9月25日开启全渠道预售以来,市场热度持续攀升,上市初期便迎来抢购热潮,一度出现全线售罄、供不应求的局面。10月23日,荣耀手表5pro正式迎来首销,提供蓝牙版与esim版两种选择。其中,蓝牙版本的攀登者(橙色)、开拓者(黑色)和远航者(灰色)首销期间享受国补优惠价,到手价为135…

    2025年12月6日 行业动态
    000
  • 环境搭建docker环境下如何快速部署mysql集群

    使用Docker Compose部署MySQL主从集群,通过配置文件设置server-id和binlog,编写docker-compose.yml定义主从服务并组网,启动后创建复制用户并配置主从连接,最后验证数据同步是否正常。 在Docker环境下快速部署MySQL集群,关键在于合理使用Docker…

    2025年12月6日 数据库
    000
  • Xbox删忍龙美女角色 斯宾塞致敬板垣伴信被喷太虚伪

    近日,海外游戏推主@HaileyEira公开发表言论,批评Xbox负责人菲尔·斯宾塞不配向已故的《死或生》与《忍者龙剑传》系列之父板垣伴信致敬。她指出,Xbox并未真正尊重这位传奇制作人的创作遗产,反而在宣传相关作品时对内容进行了审查和删减。 所涉游戏为年初推出的《忍者龙剑传2:黑之章》,该作采用虚…

    2025年12月6日 游戏教程
    000
  • 如何在mysql中分析索引未命中问题

    答案是通过EXPLAIN分析执行计划,检查索引使用情况,优化WHERE条件写法,避免索引失效,结合慢查询日志定位问题SQL,并根据查询模式合理设计索引。 当 MySQL 查询性能下降,很可能是索引未命中导致的。要分析这类问题,核心是理解查询执行计划、检查索引设计是否合理,并结合实际数据访问模式进行优…

    2025年12月6日 数据库
    000
  • VSCode入门:基础配置与插件推荐

    刚用VSCode,别急着装一堆东西。先把基础设好,再按需求加插件,效率高还不卡。核心就三步:界面顺手、主题舒服、功能够用。 设置中文和常用界面 打开软件,左边活动栏有五个图标,点最下面那个“扩展”。搜索“Chinese”,装上官方出的“Chinese (Simplified) Language Pa…

    2025年12月6日 开发工具
    000
  • php查询代码怎么写_php数据库查询语句编写技巧与实例

    在PHP中进行数据库查询,最常用的方式是使用MySQLi或PDO扩展连接MySQL数据库。下面介绍基本的查询代码写法、编写技巧以及实用示例,帮助你高效安全地操作数据库。 1. 使用MySQLi进行查询(面向对象方式) 这是较为推荐的方式,适合大多数中小型项目。 // 创建连接$host = ‘loc…

    2025年12月6日 后端开发
    000
  • 重现iPhone X颠覆性时刻!苹果2027年跳过19命名iPhone 20

    10月23日,有消息称,苹果或将再次调整iPhone的发布节奏,考虑跳过“iPhone 19”,并于2027年直接推出“iPhone 20”系列。 此举据传是为了庆祝初代iPhone发布二十周年,同时开启新一轮的设计革新,目标是复刻2017年iPhone X带来的划时代变革。 据悉,苹果或将告别长期…

    2025年12月6日 手机教程
    000
  • 如何在mysql中使用索引提高查询效率

    合理创建索引可显著提升MySQL查询效率,应优先为WHERE、JOIN、ORDER BY等高频字段建立B-Tree复合索引,如CREATE INDEX idx_status_created ON users(status, created_at, id),并遵循最左前缀原则;避免在索引列使用函数或前…

    2025年12月6日 数据库
    000

发表回复

登录后才能评论
关注微信